name: shipin-zhuan-wengao description: 调用千问大模型,将网络视频链接或本地视频文件快速转写为干净文本——自动剔除语气词、口误与重复台词等,并支持按需定制文案风格。覆盖短视频二创、会议纪要、课程拆解、直播复盘、采访整理等视频内容场景。 license: MIT metadata: enabled: true type: command runtime: "nodejs@16.14.0+" requires: bins: - "node" env: - "GUAIKEI_API_TOKEN" # 鉴权密钥,使用前必须配置 tags: - "video2text" - "video-analysis" - "content-workflow" - "短视频二创" - "会议纪要" - "课程拆解" - "直播转写" - "采访文案" - "视频脚本" - "内容提取" examples: - name: 视频OCR https://example.com/video.mp4 中的文字 command: 'node scripts/video2text/index.js --file "https://example.com/video.mp4"' - name: 帮我总结一下这个视频的核心观点 https://example.com/video.mp4 command: 'node scripts/video2text/index.js --file "https://example.com/video.mp4" --prompt "总结这个视频的核心观点"' - name: 把本地的这个 /path/to/your/video.mp4 改成小红书风格的文案 command: 'node scripts/video2text/index.js --file "/path/to/your/video.mp4" --prompt "改成小红书风格的文案"'
Whisper/FFmpeg 仅输出原始流水稿,无智能润色逻辑通过 --prompt 传入自定义指令,按需生成目标内容,覆盖全创作场景:
视频OCR:视频中文字识别,提取文字内容内容总结:提炼视频核心观点、3条核心卖点二创改写:小红书/抖音/公众号爆款文案、风趣口播稿素材提取:视频金句、完整人物对话、分镜头文案深度分析:情感基调、内容痛点、受众定位翻译处理:全文中英互译依托云端集群并行运算,不受本地电脑性能限制;几分钟短视频、数十小时长视频均可快速解析。
| 计费档位 | 单价 | 最小结算粒度 | 适用场景 |
|---|---|---|---|
| 视频时长 ≥ 1分钟 | 0.6 元/分钟 | 整分钟结算 | 课程、会议、长访谈 |
| 视频时长 < 1分钟 | 0.1 元/10秒 | 10秒为最小单位 | 短视频、片段素材 |
⚠️ 重要提示: 请先通过微信 13395823479 ,或访问 视频文案智能提取官网 开通TOKEN,并配置环境变量
GUAIKEI_API_TOKEN后才能正常运行。
# 处理本地视频文件
node scripts/video2text/index.js --file "/path/to/your/video.mp4"
# 处理在线公网视频链接
node scripts/video2text/index.js --file "https://example.com/video.mp4"
# 输出3点视频核心总结
node scripts/video2text/index.js --file "/path/to/your/video.mp4" --prompt "请用三个要点总结这个视频的核心内容"
# 改写为小红书爆款文案
node scripts/video2text/index.js --file "/path/to/your/video.mp4" --prompt "将这段内容改写成一篇风趣幽默的小红书文案"
# 复用历史任务ID,提取视频全部金句(无需重新上传视频)
node scripts/video2text/index.js --id "xxx任务ID" --prompt "提取视频中的所有金句"
# 分析视频整体情感基调
node scripts/video2text/index.js --file "/path/to/your/video.mp4" --prompt "分析视频的情感基调"
转换判定规则
--file 参数--id "last"--prompt--id,忽略 --file| 用户自然语言指令 | 自动生成命令 |
|---|---|
| 视频提取 https://example.com/video.mp4 中的文字 | node scripts/video2text/index.js --file "https://example.com/video.mp4" |
| 把本地 /path/to/your/video.mp4 改成小红书风格的文案 | node scripts/video2text/index.js --file "/path/to/your/video.mp4" --prompt "改写成小红书风格的文案" |
| 总结一下这个视频的核心观点 https://example.com/video.mp4 | node scripts/video2text/index.js --file "https://example.com/video.mp4" --prompt "总结这个视频的核心观点" |
| 用刚才分析的视频提取所有金句 | node scripts/video2text/index.js --id "last" --prompt "提取视频中的所有金句" |
Whisper、FFmpeg 本地工具对比优势| 对比项 | 传统本地方案 (Whisper/FFmpeg) | video2text-ai 千问方案 |
|---|---|---|
| 核心能力 | 纯语音 ASR 转文字 | 语音转写 + 语义理解 + 内容二次创作 |
| 输出内容 | 含杂音、口误、重复的原始流水稿 | 逻辑通顺、无冗余的精炼文案 |
| 自定义能力 | 输出格式固定,无法定制内容 | 支持任意自定义 Prompt 指令 |
| 算力依赖 | 消耗本地电脑 CPU/GPU | 云端算力,本地无性能压力 |
| 商用安全 | 无数据销毁机制 | 任务结束自动删除视频源文件 |
无限制,所有对视频内容的处理需求均可输入,举例:
整理成结构化会议纪要
🔒 视频文件安全吗?
安全。视频仅用于单次解析任务,处理完毕立即从服务器销毁,不存储、不对外泄露、不用于模型训练。
原生命令不支持批量,可自行编写 shell 脚本循环调用命令实现批量解析。
这是一个功能完整的视频转文字工具,文档清晰、使用说明详细,能支持多种视频来源和灵活的自定义文案需求。优点是操作简单、云端处理不占本地资源,适合视频内容创作者快速提取文案。不足是使用前需要付费开通 API Token,批量处理不够便捷,且核心技术依赖外部云服务。如需使用请先确认能接受按量计费模式。