douyin-video-copy-extract · git:20260717.004fd38 · 2026-07-17 · sha256 8e213349cd7fbfa1

douyin-video-copy-extract git:20260717.004fd38A

Immutable. This exact content is served forever at /api/v1/blob/8e213349cd7fbfa1.

---
name: "douyin-video-copy-extract"
description: "用于抖音文案提取、抖音文案一键提取、抖音视频文案提取、抖音视频转文字、抖音口播转文字和抖音逐字稿。用户粘贴抖音视频链接、分享文案或 aweme_id 后,提取视频上下文、原视频简介和口播逐字稿。"
source_client: "socialdatax-skills"
source_platform: "modelscope"
source_skill: "douyin-video-copy-extract"
metadata: {"openclaw":{"requires":{"env":["SOCIALDATAX_API_KEY"],"bins":["node","npm"]},"primaryEnv":"SOCIALDATAX_API_KEY","install":[{"kind":"node","package":"socialdatax-skills","bins":[]}],"emoji":"🎙️","homepage":"https://socialdatax.com/?from=modelscope"}}
---
<!-- AUTO-GENERATED from socialdatax-skill-source. Do not edit directly; run `node scripts/generate_socialdatax_skills.mjs`. -->

# 抖音文案提取

## 适用场景

用于抖音文案提取、抖音文案一键提取、抖音视频文案提取、抖音视频转文字、抖音口播转文字和抖音逐字稿。用户粘贴抖音视频链接、分享文案或 aweme_id 后,提取视频上下文、原视频简介和口播逐字稿。

## 快速开始

- 先给出当前 skill 支持的输入:视频链接、分享文案、内容 ID 或已有 job_id。
- 你通常会得到:视频基础信息、原视频简介、口播逐字稿、可复制文案和精简版;未完成时先继续查询任务状态。

## API Key 获取

获取或管理 API Key:访问 <https://socialdatax.com/?from=modelscope>,按官网的 API Key 申请/管理入口操作。环境变量名固定使用 `SOCIALDATAX_API_KEY`;不要引导用户使用其他域名。

## 直接调用命令

优先使用 direct CLI;能运行 shell 命令的 Agent 不需要额外配置 MCP server:

```bash
npx -y socialdatax-skills@latest douyin transcript \
  --url "<douyin_content_url_or_share_text>" --pretty \
  --source-client socialdatax-skills --source-platform modelscope \
  --source-skill douyin-video-copy-extract

npx -y socialdatax-skills@latest douyin transcript \
  --aweme-id "<aweme_id>" --pretty --source-client socialdatax-skills \
  --source-platform modelscope --source-skill douyin-video-copy-extract

npx -y socialdatax-skills@latest douyin transcript \
  --job-id "<job_id>" --pretty --source-client socialdatax-skills \
  --source-platform modelscope --source-skill douyin-video-copy-extract
```

## 参数说明

文案提取 / 转写:
- 输入:`--url <douyin_video_url_or_share_text>`:当用户粘贴抖音视频链接、短链或分享文案,想做文案提取 / 口播转文字时使用。
- 输入:`--aweme-id <aweme_id>`:当已经知道抖音视频 ID,想做文案提取 / 口播转文字时使用。
- 输入:`--job-id <job_id>`:继续查询已有文案提取 / 转写任务;不要为了查询状态再次提交新任务。
- 说明:单次文案提取 / 转写调用只能使用 `--url`、`--aweme-id` 或 `--job-id` 其中一种入口。

通用:
- 可选:`--pretty`:只影响输出格式,不改变实际请求结果。
- 可选:`--source-client socialdatax-skills --source-platform modelscope --source-skill douyin-video-copy-extract`:这是当前 Agent Skill 的来源标记;按本 Skill 示例执行时保持这些值不变。

执行步骤:第一步,用 `--url` 或 `--aweme-id` 提交抖音视频文案提取;如果用户已经给了 `job_id`,直接用 `--job-id` 查询。
第二步,先看返回 JSON 里的 `data.is_terminal`:如果不是 `true`,复制同一个 `data.job_id`,运行上方 `douyin transcript --job-id <job_id>` 命令继续查询。
第三步,只有 `data.is_terminal` 是 `true` 时才交付结果:如果 `data.status` 是 `succeeded`,整理视频信息、简介和逐字稿;否则说明 `data.error.message` 或 `data.message`。
循环规则:每次查询返回后都先判断 `data.is_terminal`。只要 `data.is_terminal` 不是 `true`,就继续查询同一个 `data.job_id`;先等 `data.next_poll_after_seconds`,如果没有这个字段,就短暂等待后再查。
停止条件只有三类:终态、工具无法继续运行、用户要求停止。拿到 `data.job_id` 后,提交动作最多一次;不要重复提交同一个视频,不要把只有 `data.job_id` 的内容当作最终结果。
失败时,只在 `data.error.retryable` 是 `true` 时建议稍后重试;如果是 `false`,不要建议重复提交同一个视频。

## 输出建议

优先输出可直接复制的文案提取结果:视频基础信息、原视频简介、口播逐字稿、可复制文案和精简版;未完成时继续查询任务状态。

固定输出结构:任务成功后按以下顺序组织;字段只使用返回中可见内容,缺失时标注未返回,不补造。

1. 视频基础信息:标题、作者、发布时间、时长、aweme_id、原始链接等;只有返回中存在时才输出。
2. 原视频简介:优先使用 `description`,保留原意,适合用户直接复制或继续整理。
3. 口播逐字稿:输出转写正文,尽量保持原口播顺序。
4. 可复制文案版:基于原视频简介和口播逐字稿整理为便于复制的正文,不新增未出现的信息。
5. 精简版:用短段落概括视频主要内容,方便用户快速判断是否继续复盘。
6. 任务状态:如果任务未完成或失败,只输出 `job_id`、`status`、`next_action`、错误信息和是否可重试。

优先交付 `description` 原视频简介、口播逐字稿、可复制文案、精简版,以及返回中可见的视频上下文。
输出前先检查 `data.is_terminal`:如果不是 `true`,先用同一个 `data.job_id` 继续查询,不要提前写最终文案。只有工具无法继续运行、会话被中断或用户要求停止时,才输出 `data.job_id`、`data.status` 和 `data.next_action`,提示用户稍后继续查询。
只有 `data.is_terminal` 是 `true` 且 `data.status` 是 `succeeded` 时才输出逐字稿;失败时输出 `data.error.message` 或 `data.message`。
失败时先看 `data.error.retryable`:只有值为 `true` 才建议稍后重试;值为 `false` 时说明当前视频不适合重复提交。
如果结果显示没有可处理的视频资源或任务失败,按当前任务结果说明,不要换平台重试。
除非用户另行要求,当前 skill 只做文案提取和任务状态续查,不扩展到其他分析或改写任务。

## MCP 工具

与上面 direct CLI 命令对应的 MCP 工具:

- `douyin_submit_video_speech_text_by_video_url`
- `douyin_submit_video_speech_text_by_aweme_id`
- `douyin_get_video_speech_text_job`

如果当前 Agent 已接入 MCP 工具,只使用抖音视频文案提取对应工具:`douyin_submit_video_speech_text_by_video_url`、`douyin_submit_video_speech_text_by_aweme_id`、`douyin_get_video_speech_text_job`。
继续查询已有任务时,调用 `douyin_get_video_speech_text_job`;不要为了轮询状态再次调用 submit 工具。任务未到终态时继续用同一个 `job_id` 查询。

## 安全边界

这是只读 skill,可通过 direct CLI 或 hosted MCP 提交有限范围的视频转文字分析任务,也可以查询已有任务状态。 运行时使用用户环境变量中的 `SOCIALDATAX_API_KEY`;生成的 Skill 文件不包含 API Key。 不会读取本地浏览器数据,也不会执行登录、发帖、点赞、评论或账号修改。

## 示例结果

- 示例展示格式,不代表固定字段:成功=视频基础信息/原视频简介/逐字稿/可复制文案/精简版;未完成=继续查询同一 job_id;失败=错误原因/是否可重试/下一步。

## 异常处理

- 提交或查询异常:保留错误信息,先检查 `SOCIALDATAX_API_KEY`、输入链接或 ID、以及 `job_id` 是否完整。
- 如果提交失败且没有返回 `data.job_id`,确认参数和 API Key 后可以重新提交;如果已经拿到 `data.job_id`,后续异常只查询同一个任务,不要重复提交视频。
- 任务失败:优先展示 `data.error.message` 或 `data.message`;只有 `data.error.retryable` 是 `true` 时才建议稍后重试。

## 常见问题

- 没结果:确认视频链接、分享文案、内容 ID 或 `job_id` 完整。
- 调用失败:如果已有 `job_id`,只查询同一个任务;如果没有 `job_id`,先确认 `SOCIALDATAX_API_KEY` 和输入格式。
- 担心账号安全:这是只读能力,不登录、不发帖、不点赞、不评论。
- 想整理成文案:先等任务成功,再基于逐字稿和返回上下文整理可复制版本。