
TikTok文字起こし:短編動画をテキスト化+AI要約
TikTok文字起こし — 動画を貼るだけで、言葉をテキスト化
TikTokの動画リンクを貼り付けるだけで、短い動画、長尺投稿、Storiesから、話されている言語の逐語文字起こし、あなたの言語での要約、ダウンロード可能なファイルを取得できます。設定画面を開いたり、元の言語を犠牲にしたり、TikTokの自動字幕を目で追って手入力したりする必要はありません。
このSkillは、TikTok動画内の音声を、検索、引用、翻訳できるテキストへ変換します。あらゆる言語の公開TikTok動画に対応し、プレーンテキスト、タイムスタンプ付きMarkdown、SRT字幕を出力できます。形式は設定画面ではなく、依頼文の書き方から自動的に選択されます。
対象ユーザー
- コンテンツクリエイター — 自分のTikTokをInstagram Reels、YouTube Shorts、LinkedIn、Xへ展開し、話されている台本を数秒でテキスト化して投稿ワークフローに組み込みたい人
- ソーシャルメディア担当者 — TikTokキャンペーンを海外市場向けにローカライズしたい人。逐語文字起こしが実際の発言を正確に保持し、人またはLLMによる正確な翻訳に利用できます
- マーケターや競合調査担当者 — バズったTikTok、競合アカウント、トレンドのフックを分析し、何百本もの動画を通常速度で見ずに主張、冒頭、共通パターンを確認したい人
- ブランド戦略担当者やトレンド分析担当者 — 新しいスラング、ニッチなサブカルチャー、急成長中のクリエイターを研究し、15秒の動画内で実際に何が話されているかを確認したい人
- 広告代理店のプランナー — クリエイターブリーフや台本を作成し、以前5本を見るのにかかっていた時間で50本の高成果TikTokを分析したい人
- 学生や生涯学習者 — 教育系TikTokを保存し、同じ60秒動画を4回再生する代わりに内容を一度で読みたい人
- レシピ収集者 — 料理TikTokから材料、分量、手順を抽出し、停止、巻き戻し、再停止を繰り返さずに記録したい人
- ジャーナリストやファクトチェッカー — TikTokクリエイターの発言を記事や報道で引用したい人。文字起こしは書き換えられないため、引用した言葉と実際の発言が一致します
- TikTokコンテンツを研究する人 — メディア研究、社会科学、政治コミュニケーション、プラットフォーム研究に使用し、NVivo、Atlas.tiなどへ取り込めるテキストを必要とする人
- アクセシビリティ担当者 — TikTokを他のプラットフォームへ再投稿する際に、聴覚障害のある視聴者向けのSRT字幕を作成したい人
- 語学学習者 — ネイティブ話者のTikTokを、逐語文字起こしと翻訳済み要約を組み合わせた短い教材として使用したい人
- 音を出せない環境で視聴する人 — オフィス、電車内、または近くで誰かが眠っている静かな部屋など
解決する問題
TikTokの価値は、短い動画の音声に凝縮されています。30秒のTikTokにも、フック、導入、結論、CTAが含まれ、自然な会話速度で、しばしば音楽の上から話されます。プラットフォームはコンテンツを消費するために設計されており、言葉を抽出するためのものではありません。話された内容を実用的なテキストとして取得するのは、意図的に難しくなっています。
TikTokには自動字幕がありますが、結果にばらつきがあり、アクセント、スラング、音楽の大きい動画に弱く、外部ツールやブラウザ操作なしでは簡単に書き出せません。モバイルアプリで字幕をコピーするのは難しく、Web版でも大きく改善されません。外部の文字起こしサービスもありますが、多くは次の3つの問題のいずれかを抱えています。
- 翻訳すべきでない文字起こしを翻訳してしまう。 スペイン語を話すクリエイターの発言をそのまま引用したかったのに、ツールが英語の意訳を返しました。原文の引用だけでなく、TikTokで最も重要になりやすいクリエイター独自の言い回しも失われます。
- 要約を元言語のまま返す。 韓国語を読めないのに、要約も韓国語で返されました。翻訳するために別のツールが必要になります。
- すべてを設定画面の中に隠す。 リンクを貼って一文入力したいだけなのに、APIキー、出力先、各種スイッチを設定する必要があります。
共通する問題は、これらのツールが、30秒で作業を終えたいクリエイター、マーケター、研究者ではなく、ワークフローを構築するエンジニア向けに設計されていることです。30秒は、TikTok動画そのものとほぼ同じ長さです。
このSkillに必要なのは、リンクと一文だけです。必要な結果を返します。
このSkillの違い
1. 標準で2言語を出力。
文字起こしは元の音声言語のまま逐語的に保持されます。引用は一語一句、クリエイターが発言したとおりに残ります。要約と重要ポイントは、あなたが会話で使用している言語で返されます。英語話者がスペイン語のTikTokを文字起こしすると、スペイン語の文字起こしと英語の要約を受け取ります。中国語話者が日本語の料理TikTokを処理すると、日本語の文字起こしと中国語の要約を受け取ります。切り替えスイッチや言語パラメータは必要ありません。正確な引用は一方の言語で、内容の理解は別の言語で行うことが実際の用途に適しているため、2言語出力が標準になっています。
2. 設定画面ではなく、依頼文から出力形式を判断。
「字幕を作って」と入力 → CapCut、Premiere、DaVinci Resolve、YouTube Studioで使えるSRTファイルを生成します。「フックを見つけられるようにタイムスタンプ付きで」と入力 → 各段落の先頭に[MM:SS]が付いたMarkdownを生成します。形式を指定しない → 読みやすく引用しやすいプレーンテキストを生成します。キーワードは文中の位置や活用形にかかわらず、英語、スペイン語、中国語、日本語、韓国語で認識されます。「字幕」、「タイムスタンプ」、*「자막」*も英語の同義語と同じ出力を起動します。設定ページも形式選択メニューもありません。インターフェースは、もともと入力する予定だった一文そのものです。
3. 速く、密度が高く、音楽が重なる音声にも対応。
TikTok音声は見た目以上に文字起こしが難しいものです。クリエイターは速く話し、細かくカットし、ほぼすべての動画に音楽やトレンド音源を重ねます。ポッドキャストやウェビナー向けの一般的な文字起こしツールでは、多くの単語が抜けることがあります。このSkillは短尺ソーシャル音声に最適化されています。速いテンポ、音楽の混入、スラング、複数言語の切り替え、TikTok特有の畳みかける話し方を想定し、滑らかに意訳した近似文ではなく、実際の発言に近い結果を返します。
対応するTikTokコンテンツ
| コンテンツ形式 | 対応 | 補足 |
|---|---|---|
| 標準動画(15秒~3分) | ✓ | 最も一般的なケース。多くのTikTokは10~20秒で文字起こしされます。 |
| 長尺動画(最大10分) | ✓ | チュートリアル、ストーリー系、長めのクリエイターコンテンツ向け形式。 |
| TikTok Stories | ✓ | 公開後24時間以内で、Storyが閲覧可能かつ公開されている場合。 |
| 音声付きスライドショー投稿 | ✓ | ナレーション付き写真カルーセル、または歌詞のある音楽を含む投稿。 |
| 音声のない写真投稿 | ✗ | 文字起こしできる音声トラックがありません。 |
| 配信中のTikTok Live | ✗ | 終了した録画のみ対応します。多くのLiveは公開アーカイブされません。 |
| 非公開アカウント | ✗ | TikTokへログインせずにリンクへアクセスできる必要があります。 |
| 削除済み動画 | ✗ | 動画が削除または制限されている場合、リンクから内容を取得できません。 |
使用例
例1 — バズったTikTokをReelsとShortsへ再投稿
クリエイターが投稿したTikTokが伸び始め、各プラットフォームのアクセシビリティ要件に合った字幕を付けてInstagram ReelsとYouTube Shortsへ投稿したいと考えています。
「この動画のSRT字幕を作成してください https://www.tiktok.com/@username/video/1234567890」
返される内容:
- 正しいタイムコードを含む標準SubRip形式の
.srtファイル。Reelsの字幕エディター、YouTube Studioの字幕アップロード、CapCutの字幕トラックへ直接取り込めます - 投稿文や移行先プラットフォームの動画説明欄に使える短い要約と3~6個の重要ポイント
例2 — バズったフックをマーケティング分析
グロースマーケターが、あるTikTokが500万回再生された理由を研究し、冒頭の正確な一文とCTAの構造を記録したいと考えています。
「このTikTokをタイムスタンプ付きで文字起こしして、最初の3秒を抜き出してください。そこがフックです。https://www.tiktok.com/@username/video/9876543210」
返される内容:
- 最初に冒頭のフックを表示。最初の3秒で話された逐語テキストと
[00:00]のタイムスタンプ - 構成を示す2~4文の要約:フック → 導入 → 結果 → CTA
- TikTokが機能した理由を示す3~6個の重要ポイント
- タイムスタンプ付き全文Markdown。スワイプファイルやNotionのクリエイター研究データベースへそのまま貼り付けられます
例3 — 料理TikTokからレシピを抽出
家庭料理をする人が、60秒の料理TikTokを再現しようとしています。動画の進行が速く、画面の文字も読む前に消えてしまいます。
「このレシピでは何と言っていますか? https://www.tiktok.com/@chefname/video/5556667778」
返される内容:
- 料理と調理方法をまとめた2~4文の要約
- 材料、分量、手順を整理した3~6個の重要ポイント
- 行ごとに引用できる、全文の逐語文字起こしファイル
- 形式キーワードがないため、プレーンテキストで出力
出力形式
| 形式 | 指定方法 | 用途 |
|---|---|---|
プレーンテキスト(.txt) |
標準。形式キーワードは不要 | 閲覧、要約、引用、ノート・台本・スワイプファイルへの貼り付け |
タイムスタンプ付きMarkdown(.md) |
「タイムスタンプ」、「タイムコード」、「時間付き」、「时间戳」、「タイムスタンプ」 | 正確な箇所の特定、フックの分析、動画編集の参照、レシピ手順の確認 |
SRT字幕(.srt) |
「字幕」、「captions」、「SRT」、「字幕」、「サブタイトル」、「자막」 | Reels、Shorts、X、LinkedInへの字幕付き再投稿、アクセシビリティ対応、翻訳ワークフロー |
対応言語
文字起こしエンジンは、英語、スペイン語、ポルトガル語、フランス語、ドイツ語、イタリア語、中国語、広東語、日本語、韓国語、ベトナム語、タイ語、インドネシア語、タガログ語、アラビア語、ヒンディー語、ロシア語、トルコ語、および主要なヨーロッパ・アジア言語に対応しています。TikTokの大規模な非英語圏ユーザーが使用する言語も含まれます。クリエイターが英語とスペイン語を切り替えたり、別の言語のスラングを使ったりする多言語TikTokでは、主要言語をベースに処理しますが、逐語文字起こしには実際に話された両方の言語が保持されます。
言語を指定する必要はありません。URLやクリエイター名の情報、非ラテン文字、地域を示す要素から自動判定されます。最初の試行が空だった場合、チャットで使用している言語でもう一度試行します。2回とも空の場合は確認を求められます。多くの場合、言語の誤認識ではなく、動画が非公開、年齢制限付き、地域制限付き、または削除済みであることが原因です。
音声言語が分かっている場合は、「このスペイン語のTikTok」、*「音声は日本語です」*のようにプロンプトで指定すると、自動判定を省略して数秒短縮できます。
精度と注意点
文字起こしは逐語的です。音声認識システムで生成され、書き換えや意訳は行われません。フィラー、繰り返し、スラング、TikTok特有の省略された会話表現も、話されたとおりに保持されます。クリエイターの話し方を研究する場合、報道で引用する場合、フックが機能する理由を分析する場合は、正確な言い回しそのものが重要です。
対応言語でクリエイターの声が明瞭な場合、高い精度が期待できます。歌詞のある大きなBGM、複数人の同時発話、極端に速い話し方、強い地域アクセント、激しく圧縮された音声では精度が低下する場合があります。聞き取れない音声を完全に復元できるAIシステムはありません。文章が崩れている場合、モデルの失敗ではなく、元音声自体が聞き取りにくい可能性があります。クリエイターブリーフ、ブランドキャンペーン、報道など重要度の高い用途では、重要な引用を元動画と照合してください。
このSkillが処理するのは公開動画のリンクのみです。TikTokへログインしたり、非公開コンテンツへアクセスしたりすることはありません。
対象外
- ローカル動画ファイル — TikTokから書き出した
.mp4、画面録画、パソコンに保存されたファイルには、関連するaudio-to-textSkillを使用してください - 配信中のTikTok Live — 終了した録画のみ対応し、多くのLiveは公開アーカイブされません
- 音声のない写真投稿 — ナレーションや歌詞のない画像カルーセルには文字起こしする内容がありません
- 非公開アカウント — リンクが公開アクセス可能である必要があります。Skillがユーザーに代わってTikTokへログインすることはできません
- 削除または制限された動画 — リンクから内容を取得できない場合、クリエイターが削除したか、TikTokによって削除された可能性があります
- 文字起こし本文そのものの翻訳 — 正確な引用を保持するため、本文は元言語のまま出力されます。必要な場合は、逐語文字起こしを受け取った後に翻訳を依頼してください
外部API
api.proactor.ai

