抖音文案提取
适用场景
用于抖音文案提取、抖音文案一键提取、抖音视频文案提取、抖音视频转文字、抖音口播转文字和抖音逐字稿。用户粘贴抖音视频链接、分享文案或 aweme_id 后,提取视频上下文、原视频简介和口播逐字稿。
快速开始
- 先给出当前 skill 支持的输入:视频链接、分享文案、内容 ID 或已有 job_id。
- 你通常会得到:视频基础信息、原视频简介、口播逐字稿、可复制文案和精简版;未完成时先继续查询任务状态。
API Key 获取
获取或管理 API Key:访问 https://socialdatax.com/?from=modelscope,按官网的 API Key 申请/管理入口操作。环境变量名固定使用 SOCIALDATAX_API_KEY;不要引导用户使用其他域名。
直接调用命令
优先使用 direct CLI;能运行 shell 命令的 Agent 不需要额外配置 MCP server:
npx -y socialdatax-skills@latest douyin transcript \
--url "<douyin_content_url_or_share_text>" --pretty \
--source-client socialdatax-skills --source-platform modelscope \
--source-skill douyin-video-copy-extract
npx -y socialdatax-skills@latest douyin transcript \
--aweme-id "<aweme_id>" --pretty --source-client socialdatax-skills \
--source-platform modelscope --source-skill douyin-video-copy-extract
npx -y socialdatax-skills@latest douyin transcript \
--job-id "<job_id>" --pretty --source-client socialdatax-skills \
--source-platform modelscope --source-skill douyin-video-copy-extract
参数说明
文案提取 / 转写:
- 输入:
--url <douyin_video_url_or_share_text>:当用户粘贴抖音视频链接、短链或分享文案,想做文案提取 / 口播转文字时使用。 - 输入:
--aweme-id <aweme_id>:当已经知道抖音视频 ID,想做文案提取 / 口播转文字时使用。 - 输入:
--job-id <job_id>:继续查询已有文案提取 / 转写任务;不要为了查询状态再次提交新任务。 - 说明:单次文案提取 / 转写调用只能使用
--url、--aweme-id或--job-id其中一种入口。
通用:
- 可选:
--pretty:只影响输出格式,不改变实际请求结果。 - 可选:
--source-client socialdatax-skills --source-platform modelscope --source-skill douyin-video-copy-extract:这是当前 Agent Skill 的来源标记;按本 Skill 示例执行时保持这些值不变。
执行步骤:第一步,用 --url 或 --aweme-id 提交抖音视频文案提取;如果用户已经给了 job_id,直接用 --job-id 查询。
第二步,先看返回 JSON 里的 data.is_terminal:如果不是 true,复制同一个 data.job_id,运行上方 douyin transcript --job-id <job_id> 命令继续查询。
第三步,只有 data.is_terminal 是 true 时才交付结果:如果 data.status 是 succeeded,整理视频信息、简介和逐字稿;否则说明 data.error.message 或 data.message。
循环规则:每次查询返回后都先判断 data.is_terminal。只要 data.is_terminal 不是 true,就继续查询同一个 data.job_id;先等 data.next_poll_after_seconds,如果没有这个字段,就短暂等待后再查。
停止条件只有三类:终态、工具无法继续运行、用户要求停止。拿到 data.job_id 后,提交动作最多一次;不要重复提交同一个视频,不要把只有 data.job_id 的内容当作最终结果。
失败时,只在 data.error.retryable 是 true 时建议稍后重试;如果是 false,不要建议重复提交同一个视频。
输出建议
优先输出可直接复制的文案提取结果:视频基础信息、原视频简介、口播逐字稿、可复制文案和精简版;未完成时继续查询任务状态。
固定输出结构:任务成功后按以下顺序组织;字段只使用返回中可见内容,缺失时标注未返回,不补造。
- 视频基础信息:标题、作者、发布时间、时长、aweme_id、原始链接等;只有返回中存在时才输出。
- 原视频简介:优先使用
description,保留原意,适合用户直接复制或继续整理。 - 口播逐字稿:输出转写正文,尽量保持原口播顺序。
- 可复制文案版:基于原视频简介和口播逐字稿整理为便于复制的正文,不新增未出现的信息。
- 精简版:用短段落概括视频主要内容,方便用户快速判断是否继续复盘。
- 任务状态:如果任务未完成或失败,只输出
job_id、status、next_action、错误信息和是否可重试。
优先交付 description 原视频简介、口播逐字稿、可复制文案、精简版,以及返回中可见的视频上下文。
输出前先检查 data.is_terminal:如果不是 true,先用同一个 data.job_id 继续查询,不要提前写最终文案。只有工具无法继续运行、会话被中断或用户要求停止时,才输出 data.job_id、data.status 和 data.next_action,提示用户稍后继续查询。
只有 data.is_terminal 是 true 且 data.status 是 succeeded 时才输出逐字稿;失败时输出 data.error.message 或 data.message。
失败时先看 data.error.retryable:只有值为 true 才建议稍后重试;值为 false 时说明当前视频不适合重复提交。
如果结果显示没有可处理的视频资源或任务失败,按当前任务结果说明,不要换平台重试。
除非用户另行要求,当前 skill 只做文案提取和任务状态续查,不扩展到其他分析或改写任务。
MCP 工具
与上面 direct CLI 命令对应的 MCP 工具:
douyin_submit_video_speech_text_by_video_urldouyin_submit_video_speech_text_by_aweme_iddouyin_get_video_speech_text_job
如果当前 Agent 已接入 MCP 工具,只使用抖音视频文案提取对应工具:douyin_submit_video_speech_text_by_video_url、douyin_submit_video_speech_text_by_aweme_id、douyin_get_video_speech_text_job。
继续查询已有任务时,调用 douyin_get_video_speech_text_job;不要为了轮询状态再次调用 submit 工具。任务未到终态时继续用同一个 job_id 查询。
安全边界
这是只读 skill,可通过 direct CLI 或 hosted MCP 提交有限范围的视频转文字分析任务,也可以查询已有任务状态。 运行时使用用户环境变量中的 SOCIALDATAX_API_KEY;生成的 Skill 文件不包含 API Key。 不会读取本地浏览器数据,也不会执行登录、发帖、点赞、评论或账号修改。
示例结果
- 示例展示格式,不代表固定字段:成功=视频基础信息/原视频简介/逐字稿/可复制文案/精简版;未完成=继续查询同一 job_id;失败=错误原因/是否可重试/下一步。
异常处理
- 提交或查询异常:保留错误信息,先检查
SOCIALDATAX_API_KEY、输入链接或 ID、以及job_id是否完整。 - 如果提交失败且没有返回
data.job_id,确认参数和 API Key 后可以重新提交;如果已经拿到data.job_id,后续异常只查询同一个任务,不要重复提交视频。 - 任务失败:优先展示
data.error.message或data.message;只有data.error.retryable是true时才建议稍后重试。
常见问题
- 没结果:确认视频链接、分享文案、内容 ID 或
job_id完整。 - 调用失败:如果已有
job_id,只查询同一个任务;如果没有job_id,先确认SOCIALDATAX_API_KEY和输入格式。 - 担心账号安全:这是只读能力,不登录、不发帖、不点赞、不评论。
- 想整理成文案:先等任务成功,再基于逐字稿和返回上下文整理可复制版本。
微信扫一扫