音声ファイルをテキストに書き起こし、オプションで話者分離や既知の話者ヒントを利用可能。ユーザーが音声・動画から音声を書き起こすよう依頼した場合や、テキストを抽出する際に使用。
npx skills add https://github.com/firecrawl/skills --skill transcribe