全新推出 BillionVerify:以 1% 的成本验证数十亿邮箱。 试用 BillionVerify

transcript.im

面向 DeepSeek Harness 的原生工具

面向 DeepSeek Harness 的转录

把视频背后的原始文本交给你的 DeepSeek Harness 智能体。transcript.im 插件把转录获取、YouTube 发现和批量工具直接加入你的 Harness 配置,让智能体在写作、比较或回答之前先收集证据。

  • 11 个工具直接注册到 DeepSeek Harness
  • 公开视频转录,可选时间戳
  • YouTube 搜索、频道、播放列表与字幕发现
  • 为你的智能体工作流返回结构化结果
面向 DeepSeek Harness 的转录:代理对视频链接调用原生转录工具

智能体随时可用的视频来源

面向 DeepSeek Harness 的转录通过原生插件把智能体连接到 transcript.im API。它给智能体可调用的工具,而不是让你在浏览器和对话之间来回复制文本。

从一个公开视频链接开始,或在 YouTube 上发现来源。插件可以查看转录元数据、获取文本,并返回智能体下一步能用的结构化数据。时间戳选项能把一句引用或一个观察对应回原始位置。视频简介不能代替转录:拿到真正说出口的内容,智能体才有可以引用的材料。
插件提供的是获取和发现工具。结果怎么用由你的智能体决定,无论是整理研究笔记、比较多场演讲,还是列出新文章的大纲。摘要和翻译提示在你的智能体工作流里运行,并不是这个插件提供的独立 AI 工具。

从链接到可用的来源

把来源收集和下一步研究放在同一个 DeepSeek Harness 会话里。

视频转录工具:视频链接变成代理可用的带时间戳来源

1. 选择来源

给智能体一个公开视频链接,或让它按具体主题搜索 YouTube。处理频道和播放列表时,先让它列出相关视频,再决定处理哪些来源。YouTube 发现工具覆盖搜索、频道、播放列表和字幕元数据。

2. 获取转录

先用 get_transcript_info 查看可用语言,再用 get_transcript 获取来源。下一步需要引用时,要求带上时间戳和元数据。请求可以指定语言优先级,并通过 API 请求语音识别。

3. 从结果继续工作

让智能体从返回的文本中提取引用、比较论点或整理笔记。把来源链接和时间戳与结果放在一起。面对一个集合时,创建批量任务、查看状态,然后导出已完成的结果。

你可以搭建什么

同一个插件既能处理单个来源,也能支撑可重复的集合工作流。

来源可追溯的研究

围绕一个具体问题收集转录,让智能体把直接引用和解释分开。把来源链接和时间戳放在每条论断旁边,这样在依赖结果之前可以先核对原始录音。

比较一个频道或播放列表

列出 YouTube 频道或播放列表里的视频,选出一组相关的,然后提交批量任务。处理完成后,比较结果之间反复出现的主题或前后变化的说法,而不是把单个片段当成全部故事。

用录音准备内容

把转录交给智能体,作为笔记、大纲或初稿的素材。对照录音核对人名、引用和上下文。写作由智能体完成,transcript.im 提供它据以工作的文本。

自动化转录收集

在更大的工作流里使用规范的 JSON 结果。导出前查看批量状态,继续收集来源时保留分页令牌,用同一套工具查看用量,而不是另外维护一个发现客户端。

十一个工具,一个插件

原生插件提供的能力与 transcript.im 开发者工作流使用的 REST 能力一致。转录获取支持 YouTube、TikTok、Instagram、LinkedIn 和 Twitter/X 的公开视频链接;发现功能仅限 YouTube。

DeepSeek Harness 插件:一个已启用的插件内含 11 个转录与 YouTube 工具
任务工具结果
读取一个视频get_transcript, get_transcript_info转录文本或分段、元数据,以及可用语言信息。
处理一个集合create_batch, get_batch, export_batch可跟踪的批量任务,以及可导出的已完成结果。
查找 YouTube 来源search_video, get_channel用于挑选来源的搜索结果和频道信息。
探索 YouTube 集合list_channel_video, list_playlist_item, list_caption视频列表、播放列表条目、字幕元数据,以及可用时的分页令牌。list_caption 读取 YouTube 公开的字幕轨和 transcript.im 能提供的字幕文本,不会启动语音识别。
查看用量get_usage与你的凭据关联的 API 用量信息。

连接你的 Harness 配置

插件把 transcript.im 的工具注册到 DeepSeek Harness 配置里,并用你 transcript.im 账户的开发者 API 密钥调用 REST API。

把插件安装到你的智能体使用的配置里。示例从你机器上的文件添加插件包,不会从 transcript.im 下载任何内容;把配置名和路径换成你自己的值。
把插件安装到 Harness 配置
dsh plugin --profile research add ./transcript-im-dsh-plugin-0.1.0.tgz
在你的账户里创建 transcript.im 开发者 API 密钥,并让启动 Harness 的进程能拿到它。用环境变量可以避免把凭据写进对话。插件配置里显式的 apiKey 优先于环境变量,所以如果你打算用环境变量,先删掉过时的配置值。
配置凭据并启动你的配置
export TRANSCRIPT_API_KEY="YOUR_TRANSCRIPT_API_KEY"
dsh --profile research
先拿一个公开视频,让智能体查看它的转录信息。这样能在搭建更长的工作流之前检查凭据和来源。如果插件报告 missing_api_key,请检查实际运行 Harness 的进程环境,而不只是另一个终端窗口。

选择合适的连接方式

选择适合你智能体现有运行环境的连接方式。原生 Harness 插件不需要 transcript.im MCP 服务器作为中间步骤。

连接方式何时选择如何配合
DeepSeek Harness 插件你在 DeepSeek Harness 里运行智能体。在 Harness 配置里注册原生工具,并调用 REST API。
Transcript MCP 服务器你的客户端通过 MCP 连接工具。通过 MCP 协议提供转录和发现操作。
Transcript Skills你的运行环境从技能包加载指令。为智能体提供任务指引和工作流。
Transcript API你自己控制应用或脚本。让你的代码直接调用 REST 端点。

保留原始结果

模型上下文和存储的来源数据用途不同。每一步都要用对输出。

  • 展示给模型的长转录文本由 maxTranscriptChars 限制,默认 20,000 个字符。截断标记会告诉智能体它只拿到节选;规范的 JSON 结果保持完整。
  • 文本批量导出可以内联展示。ZIP 导出是二进制,所以面向模型的响应只描述它,而不会把压缩包塞进对话。
  • YouTube 发现响应在 API 提供 nextPageToken 时会保留它。把该令牌传进下一次请求以继续收集,而不是重复第一页。
  • 插件默认把请求发送到 https://api.transcript.im。baseUrl、timeoutMs 和 maxTranscriptChars 都可以配置;默认请求超时为 30,000 毫秒。
  • 来源可用性和转录质量取决于视频。让智能体明确报告获取错误和缺失内容,并对照原始录音核对引用。

相关

DeepSeek Harness 常见问题

什么是面向 DeepSeek Harness 的转录?

面向 DeepSeek Harness 的转录是 transcript.im 插件,提供原生的视频转录和 YouTube 发现工具。它在 Harness 配置里注册 11 个工具,并调用 transcript.im REST API。

如何把 transcript.im 插件连接到 DeepSeek Harness?

把插件包安装到你的智能体使用的 Harness 配置里,在 transcript.im 账户里创建开发者 API 密钥,再通过 TRANSCRIPT_API_KEY 或插件配置把它交给 Harness 进程。连接一节展示了这两个步骤。

Harness 插件能读取哪些视频平台?

转录获取工具接受 YouTube、TikTok、Instagram、LinkedIn 和 Twitter/X 的公开视频链接。搜索、频道、播放列表和字幕元数据工具面向 YouTube。

DeepSeek Harness 插件需要 MCP 服务器吗?

DeepSeek Harness 插件直接调用 REST API,所以这种连接不需要 transcript.im MCP 服务器。当你的客户端更习惯 MCP 工具时,再使用 MCP 服务器。

API 密钥如何传给插件?

除非插件配置里设置了显式的 apiKey,否则插件会从进程环境读取 TRANSCRIPT_API_KEY。配置值优先;凭据应放在该环境或配置里,而不是提示词里。

Harness 插件能返回时间戳和语言信息吗?

用 get_transcript_info 查看可用的转录语言,并在获取转录时设置 includeTimestamp。language 参数接受一个优先级列表,其中可以包含 API 支持的语音识别偏好。

DeepSeek Harness 能把播放列表当作批量任务处理吗?

插件提供播放列表发现,以及 create_batch、get_batch 和 export_batch。让智能体先确定来源集合、创建批量任务、查看状态,再导出已完成的结果,而不是把提交当成完成。

插件会自己总结或翻译视频吗?

插件提供获取、发现、批量和用量工具。你的智能体可以用返回的转录做摘要或翻译,但插件不会注册单独的 AI 摘要或翻译工具。

为什么长转录会出现截断标记?

插件用 maxTranscriptChars 限制放进模型上下文的转录文本。标记表示只是节选,规范的 JSON 结果保持完整;智能体不应声称自己读过被省略的内容。

Harness 里出现 missing_api_key 怎么办?

检查运行所选配置的进程是否有 TRANSCRIPT_API_KEY 或已配置的 apiKey。如果存在配置值,只改环境变量并不会替换它。

可以把插件指向别的 API 源吗?

当你的部署需要不同于 transcript.im 的 API 源时,在插件配置里设置 baseUrl。默认是 https://api.transcript.im;请让凭据与你配置的目标相匹配。

它和 Transcript Skills 有什么不同?

Transcript Skills 描述兼容智能体可以遵循的任务和工作流。DeepSeek Harness 插件在运行环境里注册可调用的工具;当你的智能体需要原生 Harness 连接时选它。

把来源交给你的 Harness 智能体

创建开发者 API 密钥,把视频转录带进你的下一个研究工作流。