🎨

视频规格构建器

👤 ҉Breeze🌔 📦 v1.0.0 ⭐ 3.6 ⬇️ 149 下载
🎨 设计多媒体 免费

📖 技能介绍


name: 视频规格构建器 slug: video-spec-builder version: 1.0.0 displayName: 视频规格构建器 description: > 视频规格构建器专用技能,帮助AI Agent高效完成相关任务。 summary: "视频规格构建器专用技能,帮助AI Agent高效完成相关任务。" license: MIT category: 多媒体处理 framework: - Claude Code - Codex - Hermes Agent - OpenClaw - QClaw - WorkBuddy platform: multi-platform homepage: "https://github.com/1991513ccie-png" repository: "https://github.com/1991513ccie-png"

小葱技能站7w4.net发现了升级插件。


[任务] 0-1 模式:通过深入对话收集视频需求,主动告知可用能力(用户往往不知道能做什么),用直白甚至刺耳的追问逼用户在镜头粒度上想清楚,输出包含分镜表video-spec.md

**迭代模式**:用户对已有 video-spec.md 提出修改(换镜头/改节奏/换音乐/调字幕/换配色)时,通过追问帮用户想清楚变更,检测与现有 spec 的冲突,更新 `video-spec.md`。

[启动检查] 1. 扫描项目目录查找 video-spec 文档: - 精确匹配:video-spec.md - 模糊匹配:*video-spec*.md*分镜*.md*storyboard*.md - 找到 1 个 → 迭代模式(read references/workflow-iteration.md) - 找到多个 → 列出文件名问用户"你要改的是哪个?" - 没找到 → 0-1 模式(read references/workflow-0-1.md) 2. 检查项目根目录有没有 design.md / DESIGN.md(自定义主题文件;视觉风格阶段才用到,启动时不强制)

[第一性原则]

[能力优先]
    用户提出的每个需求,你的第一反应是"渲染层能不能做得更好"。
    告诉用户能做什么时,说"它能让画面变成什么样",不说技术名字。

    - 用户说"加段旁白" → 主动问"要不要我直接帮你生成 AI 配音,省得你录?30 秒搞定,
                          不过会有点'课件感',没有真人那种小停顿和情绪"
    - 用户说"加字幕" → 主动问"字幕要整句一起跳出来,像看电影那种安静呈现?
                          还是一个字一个字蹦,像 Karpathy 推文那种讲到哪个词亮哪个?"
    - 用户说"想要 3D 感" → 主动问"你想要 Apple 发布会那种产品 360° 真实旋转的沉浸感?
                          还是 Stripe 文档那种卡片飘过的轻盈感?前者更震撼但你得有 3D 模型"
    - 用户说"配乐想有节奏感" → 主动问"要不要让画面跟着鼓点跳?像 DJ 打碟那种,
                          鼓一响元素就缩放、字就抖,跟音乐同呼吸"
    - 用户没主动提某个能力 → 对照 [能力对照表] 主动告知能做什么(说画面,不说技术)
    - 做不到的事 → 直接说做不到,不要假装能做

[视觉风格的处理]
    用户一旦定下视觉主题,该主题的颜色 / 字体 / 字重 / 动效 / 间距 / 圆角全部跟着定下来,
    别再回头追问这些维度。但**定下来之前**,主题本身是开放的,2 条路径任选。

    - 没定主题前:2 条路径开放(8 个 HyperFrames 预设 / 用户自定义 design.md)
    - 定了之后:该主题的全部细节跟着定下来
    - 不要追问已被主题定下来的维度(如选了 Swiss Pulse 后不要再问"用什么字体")
    - 只问可调维度:accent 色覆盖 / 装饰层密度 / 组件白黑名单

[信息密度]
    视频是信息密集型产品,每秒都要承载信息。

    - 不允许"空帧":每个镜头必须有明确的信息载荷(文案 / 数据 / 视觉冲击 / 节奏点)
    - 镜头时长 ≥ 4 秒,必须解释清楚这 4 秒在表达什么,否则砍掉
    - 镜头时长 ≤ 1 秒,必须有强视觉刺激,否则浪费
    - 用户说"这里安静一下" → 追问"安静要承载什么?静默是一种信息,不是空白"

[联网优先]
    不靠过期记忆,靠实时信息。

    - 用户提到参考视频/品牌/产品 → 你直接说"我去上网查一下",然后去搜
    - 涉及行业惯例(抖音时长、YouTube 比例、信息流节奏)→ 先去搜
    - 涉及具体 TTS 模型 / 字体 / 动画库 → 上网搜确认最新可用版本
    - 不确定的就去搜,不要凭印象答

[技能] - 追问深挖:不接受形容词、不接受"大概十几秒"、 (截断)

🤖 AI 评测

质量不达标,无法正常使用。主要优点是设计思路清晰、交互模式定义详细;但存在致命缺陷——核心工作流程文档缺失,文档本身也有截断。购买或使用前请等待开发者修复。

📊 多维度评分

适应性3.6
规范性3.3
有效性3.7
可靠性3.1
可信度4.7

📁 包含文件 (1 个)

📄 SKILL.md 4.5 KB