跳转到主要内容
自媒体 / 内容创作

短剧脚本 · 把干货稿改成能拍的分镜

深度思考模型把干货稿改成 60 秒口播脚本,按 JSON 逐镜输出。

免责声明:本页展示内容均为 AI 模型生成,仅供参考,不构成任何效果承诺;实际产出效果与 Credits 消耗以平台用量统计为准。
手上有一篇资料或干货稿,想改成一条能直接拍的口播短视频。难点不在"写得顺",而在三件容易翻车的事:时长要卡准、台词要念得完、数字不能编——尤其知识类内容,编错一个数据就翻车。 调用链:qwen3.8-max(深度思考)· 一篇「久坐危害」科普干货稿 · 让它改编成 60 秒口播短视频脚本、按 JSON 逐镜输出(每镜含画面 / 台词 / 秒数)· 要求台词里的数字只能来自原稿、不许自己编。 产出一句:钩子「久坐上班族,先别划走,和你有关」+ 11 个镜头,每镜画面/台词/秒数俱全,加总正好 60 秒——展开看完整分镜表。

步骤:把「别编数字」写死

把原稿连同下面的指令发给 qwen3.8-max
你是短视频脚本编剧。请把下面这份科普稿改编成一条 60 秒的口播短视频脚本,用于知识类账号。
严格按 JSON 输出:
{
  "title": "视频标题(吸引点击,不夸张不标题党)",
  "hook": "前 3 秒的钩子文案(一句话)",
  "shots": [ {"no": 1, "visual": "画面描述", "narration": "口播台词", "seconds": 5}, ... ],
  "total_seconds": 60, "bgm": "配乐情绪", "cta": "结尾互动一句话"
}
硬性要求:
1. 所有镜头 seconds 相加必须正好 60
2. 口播里出现的每一个数字、事实都必须来自下面的原稿,不许自己发挥、不许编造数据;原稿没有的数字不要写进台词
3. 台词口语化、能直接念;每句字数和秒数匹配(正常语速约每秒 4-5 字)
4. 至少保留原稿里的 3 个关键数据点
5. 钩子勾住目标人群,但不要贩卖焦虑到失实
原稿如下:【粘贴你的干货稿 / 资料】
标题:久坐上班族自救:每天坐 9.3 小时怎么办?
钩子:久坐上班族,先别划走,和你有关。

镜  时长  画面 / 口播台词
---------------------------------------------------------
1   3s   工位特写,看向镜头
         「久坐上班族,先别划走,和你有关。」
2   5s   程序员/设计师/财务图标,进度条拉到 9.3 小时
         「程序员、设计师、财务,每天平均连续坐 9.3 小时。」
3   5s   饼图弹出 41%,时钟快进超过 2 小时
         「其中有 41% 的人,坐超 2 小时才起身一次。」
4   7s   脂蛋白脂肪酶活性下滑 90% 动画
         「坐下 90 分钟后,脂蛋白脂肪酶活性约下降 90%,同样饮食更易囤脂肪。」
5   5s   腿部血管示意,血流速度条下降约 50%
         「持续坐 3 小时,腿部血流速度会下降约 50%。」
6   6s   腰椎压力对比图
         「坐姿腰椎压力约是站立 1.4 倍,含胸驼背到 1.9 倍。」
7   8s   研究数据图表:80 万人、8 小时、59%
         「80 万人研究:每天久坐超 8 小时又几乎不运动,比少于 4 小时的人
           全因死亡风险高 59%。」
8   6s   快走、骑车画面,字幕 60-75 分钟
         「每天 60 到 75 分钟中等强度活动,这部分风险几乎能抵消。」
9   4s   计时器 20 分钟,坐 8 站 2 演示
         「试试每 20 分钟里,坐 8 分钟、站 2 分钟。」
10  4s   坐满 1 小时起身接水,字幕至少 5 分钟
         「每坐满 1 小时,要起来至少活动 5 分钟。」
11  7s   主播对镜总结,评论区弹「起身」动画
         「危害不是坐,是长时间不动,每隔一小段时间动一动,评论区打"起身"吧。」
---------------------------------------------------------
合计 60 秒  ·  配乐:轻快理性的科普感  ·  CTA:评论区打"起身"

说明

  • 消耗:本玩法涉及文本生成 + 深度思考(qwen3.8-max)。这类"多重硬约束"任务思考量极大:本次正文才 16 KB,思考却花了 3 万多字——它在反复调配每镜的秒数与字数、同时核对数字来源。产出不长,但别按字数估成本。
  • 为什么用 JSON 输出:逐镜的秒数、台词拆成字段后,时长和语速可以用几行代码精确核对,也能直接对接剪辑/配音工具;比一段大白话的分镜表可控得多。
  • 语速阈值参考:中文口播舒适区约 4-5 字/秒,超过 6.5 字/秒基本念不完。可以把这条也写进提示词让它自检。
  • 数字来源:关键约束是那句"数字只能来自原稿、原稿没有的不要写"——知识类、带数据的内容尤其要保留,否则模型容易顺手补一个看起来合理但其实没出处的数字。