DeepSeek Harness 向けネイティブツール
DeepSeek Harness 向け文字起こし
DeepSeek Harness エージェントに、動画の背後にある元テキストを渡しましょう。transcript.im プラグインは文字起こしの取得、YouTube 探索、バッチツールを Harness プロファイルに直接追加するので、エージェントは書く・比べる・答える前に根拠を集められます。
- DeepSeek Harness に直接登録される 11 個のツール
- タイムスタンプ指定ができる公開動画の文字起こし
- YouTube 検索、チャンネル、プレイリスト、字幕の探索
- エージェントのワークフロー向けの構造化された結果

エージェントですぐ使える動画ソース
DeepSeek Harness 向け文字起こしは、ネイティブプラグインを通じてエージェントを transcript.im API に接続します。ブラウザと会話の間でテキストをコピーさせる代わりに、エージェントが呼び出せるツールを渡します。
リンクから使えるソースへ
ソースの収集と次の調査ステップを、同じ DeepSeek Harness セッションで進めましょう。

1. ソースを選ぶ
エージェントに公開動画のリンクを渡すか、YouTube で特定のテーマを検索させます。チャンネルやプレイリストを扱うときは、どのソースを処理するか決める前に、該当する動画を列挙させましょう。YouTube 探索ツールは検索、チャンネル、プレイリスト、字幕メタデータをカバーします。
2. 文字起こしを取得する
get_transcript_info で利用できる言語を調べ、次に get_transcript でソースを取得します。次の作業で引用が必要なら、タイムスタンプとメタデータを要求しましょう。リクエストでは言語の優先順位を指定し、API 経由で音声認識を要求できます。
3. 結果から作業する
エージェントに、返されたテキストから引用を抜き出す、主張を比較する、メモをまとめるよう指示します。結果と一緒に元の URL とタイムスタンプを残しましょう。まとめて扱う場合は、バッチを作成し、状態を確認し、完了した結果を書き出します。
作れるもの
1 本のソースにも、繰り返し使えるコレクションのワークフローにも、同じプラグインを使えます。
追跡できるソースで調査する
特定の問いに向けて文字起こしを集め、エージェントに直接引用と解釈を分けさせます。各主張のそばにソースリンクとタイムスタンプを残し、結果を信頼する前に元の録画を確認できるようにしましょう。
チャンネルやプレイリストを比較する
YouTube チャンネルやプレイリストの動画を列挙し、関連するまとまりを選んでバッチとして送信します。処理が終わったら、1 本のクリップを話の全体とみなさず、結果全体で繰り返すテーマや変わる説明を比べましょう。
録画からコンテンツを準備する
メモ、構成、下書きの元資料として、エージェントに文字起こしを渡します。人名、引用、文脈は録画と照らして確認しましょう。文章を書くのはエージェントで、transcript.im はその作業のもとになるテキストを提供します。
文字起こしの収集を自動化する
正規の JSON 結果をより大きなワークフローで使います。書き出す前にバッチの状態を確認し、ソースをさらに集めるときはページネーショントークンを保ち、別の探索クライアントを維持せず同じツール群で使用量を確認しましょう。
11 個のツール、1 つのプラグイン
ネイティブプラグインは、transcript.im の開発者ワークフローが使うのと同じ REST 機能を公開します。取得は YouTube、TikTok、Instagram、LinkedIn、Twitter/X の公開動画 URL に対応し、探索は YouTube に限られます。

| 作業 | ツール | 結果 |
|---|---|---|
| 動画を読む | get_transcript, get_transcript_info | 文字起こしのテキストまたはセグメント、メタデータ、利用できる言語の情報。 |
| コレクションを処理する | create_batch, get_batch, export_batch | 監視するバッチと、書き出せる完了済みの結果。 |
| YouTube のソースを探す | search_video, get_channel | ソースを選ぶための検索結果とチャンネル情報。 |
| YouTube のコレクションを調べる | list_channel_video, list_playlist_item, list_caption | 動画一覧、プレイリスト項目、字幕メタデータ、利用できる場合はページネーショントークン。list_caption は YouTube が公開する字幕トラックと、transcript.im が提供できる字幕テキストを読み取り、音声認識は開始しません。 |
| 使用量を確認する | get_usage | 認証情報に関連づけられた API 使用量の情報。 |
Harness プロファイルを接続する
プラグインは DeepSeek Harness プロファイル内に transcript.im のツールを登録し、transcript.im アカウントの開発者 API キーで REST API を呼び出します。
dsh plugin --profile research add ./transcript-im-dsh-plugin-0.1.0.tgzexport TRANSCRIPT_API_KEY="YOUR_TRANSCRIPT_API_KEY"
dsh --profile research適切な接続を選ぶ
エージェントがすでに動いている実行環境に合う接続を使いましょう。ネイティブの Harness プラグインは、transcript.im MCP サーバーを中間ステップとして必要としません。
| 接続 | 選ぶとき | 合い方 |
|---|---|---|
| DeepSeek Harness プラグイン | DeepSeek Harness でエージェントを動かすとき。 | Harness プロファイルにネイティブツールを登録し、REST API を呼び出します。 |
| Transcript MCP サーバー | クライアントが MCP でツールをつなぐとき。 | MCP プロトコルで文字起こしと探索の操作を公開します。 |
| Transcript Skills | 実行環境がスキルパックから指示を読み込むとき。 | エージェント向けの作業ガイドとワークフローを提供します。 |
| Transcript API | アプリケーションやスクリプトを自分で制御するとき。 | コードが REST エンドポイントを直接呼び出せるようにします。 |
元の結果を保つ
モデルのコンテキストと保存されたソースデータは役割が違います。各ステップに適した出力を使いましょう。
- モデルに見せる長い文字起こしは maxTranscriptChars で制限され、既定値は 20,000 文字です。切り詰めの印は、エージェントが抜粋しか持っていないことを伝えます。正規の JSON 結果はそのまま保たれます。
- テキストのバッチ書き出しはインラインで提示できます。ZIP 書き出しはバイナリなので、モデル向けの応答はアーカイブを会話に挿入せず、説明だけを返します。
- YouTube 探索の応答は、API が返す場合は nextPageToken を保ちます。最初のページを繰り返さず、そのトークンを次のリクエストに渡してコレクションを続けましょう。
- プラグインは既定で https://api.transcript.im にリクエストを送ります。baseUrl、timeoutMs、maxTranscriptChars は設定でき、既定のリクエストタイムアウトは 30,000 ミリ秒です。
- ソースの可用性と文字起こしの品質は動画によって変わります。取得エラーと欠けた資料をエージェントにはっきり報告させ、引用は元の録画と照らして確認しましょう。
関連
DeepSeek Harness のよくある質問
DeepSeek Harness 向け文字起こしとは何ですか?
DeepSeek Harness 向け文字起こしは、ネイティブな動画文字起こしと YouTube 探索のツールを提供する transcript.im プラグインです。Harness プロファイルに 11 個のツールを登録し、transcript.im REST API を呼び出します。
transcript.im プラグインを DeepSeek Harness に接続するには?
エージェントが使う Harness プロファイルにプラグインバンドルをインストールし、transcript.im アカウントで開発者 API キーを作成し、TRANSCRIPT_API_KEY として、またはプラグイン設定で Harness プロセスに渡します。接続のセクションに両方の手順があります。
Harness プラグインはどの動画プラットフォームを読めますか?
文字起こしの取得ツールは、YouTube、TikTok、Instagram、LinkedIn、Twitter/X の公開動画 URL を受け付けます。検索、チャンネル、プレイリスト、字幕メタデータのツールは YouTube を対象にします。
DeepSeek Harness プラグインに MCP サーバーは必要ですか?
DeepSeek Harness プラグインは REST API を直接呼び出すため、この接続に transcript.im MCP サーバーは必要ありません。クライアントが MCP ツールを好む場合は MCP サーバーを使ってください。
API キーはプラグインにどう渡しますか?
プラグイン設定に明示的な apiKey がなければ、プラグインはプロセスの環境から TRANSCRIPT_API_KEY を読み取ります。設定された値が優先されるため、認証情報はプロンプトではなくその環境か設定に置きます。
Harness プラグインはタイムスタンプと言語情報を返せますか?
get_transcript_info で利用できる文字起こし言語を調べ、文字起こしを取得するときに includeTimestamp を設定します。language パラメータは優先順位のリストを受け付け、API が対応する音声認識の指定も含められます。
DeepSeek Harness はプレイリストをバッチとして処理できますか?
プラグインはプレイリストの探索に加え、create_batch、get_batch、export_batch を提供します。送信すれば完了だと決めつけず、エージェントに元のコレクションを特定させ、バッチを作成し、状態を確認し、完了した結果を書き出させましょう。
プラグインは動画を要約したり翻訳したりしますか?
プラグインが提供するのは取得、探索、バッチ、使用量のツールです。エージェントは返された文字起こしを要約や翻訳の作業に使えますが、プラグインは別個の AI 要約・翻訳ツールを登録しません。
長い文字起こしに切り詰めの印が出るのはなぜですか?
プラグインは maxTranscriptChars で、モデルのコンテキストに入れる文字起こしのテキストを制限します。印は抜粋を示し、正規の JSON 結果はそのまま残ります。エージェントは省かれた内容を読んだと主張すべきではありません。
Harness の missing_api_key はどう解決しますか?
選択したプロファイルを実行するプロセスに TRANSCRIPT_API_KEY または設定された apiKey があるか確認します。設定値がある場合、環境変数だけを変えても置き換わりません。
プラグインを別の API オリジンに向けられますか?
配備先で transcript.im とは別の API オリジンが必要なときは、プラグイン設定で baseUrl を設定します。既定は https://api.transcript.im です。設定した接続先に合った認証情報を保ってください。
Transcript Skills とはどう違いますか?
Transcript Skills は、対応するエージェントが従える作業とワークフローを記述します。DeepSeek Harness プラグインは実行環境に呼び出せるツールを登録します。エージェントにネイティブの Harness 接続が必要なときに選んでください。