gbro-collage-broll:半调纸拼贴 B-roll 生成 skill(三闸门审批,Gemini Omni Flash 首尾帧组装动画)
一个基于 Gemini Omni Flash 的半调纸拼贴风格 B-roll 生成 skill,通过三闸门人工审批流程,将约 5 秒口播文稿转化为 9:16、5 秒、720×1280、24fps 的无声 MP4 动画。
适用大模型
社区作者 · Aitroys 管理员
它解决什么问题
该 skill 将一句约 5 秒的口播文稿压成一个 sharp visual idea,再生成高级编辑风半调纸拼贴(halftone paper-collage)组装动画 B-roll。效果包括:强烈平坦的纯色纸面色场、黑白 halftone 照片剪贴、彩色卡纸点缀;元素从空场逐件滑入、卡位、组装,形成 stop-motion 质感,不是淡入或慢 zoom。默认交付 9:16、5 秒、720×1280、24fps、无声 MP4,可直接垫在口播下面。
核心是三阶段审批:Gate 1 只输出视觉隐喻方案(核心意思 / 关键物件 / 底色 / 组装顺序),不生成任何图片视频;Gate 2 确认后才生成彩色拼贴静帧 + contact sheet;Gate 3 静帧通过后自动用 gemini-omni-flash-preview 做首尾帧组装动画,附完整 QA(逐秒抽帧、首帧空场验证、尾帧对照)。批量模式下支持部分通过,只有确认过的条目进入下一阶段。
环境要求包括 Codex 环境(Gate 2 静帧生成依赖内置 image_gen 工具)、GEMINI_API_KEY、Python >= 3.10、google-genai >= 2.10.0、ffmpeg/ffprobe。视频生成脚本已随 skill 自带,无需额外安装其他 skill。
— 本文由 AI 根据公开来源辅助整理,命令、版本与许可证请在使用前到原始页面复核。
安装 / 开始使用
- 环境要求:需要 Codex 环境(Gate 2 静帧生成依赖内置 image_gen 工具)、GEMINI_API_KEY(在 Google AI Studio 创建,视频生成按量计费)、Python >= 3.10、google-genai >= 2.10.0、ffmpeg/ffprobe。skill 自带视频生成脚本 scripts/generate_video.py 和 scripts/upload_file.py,无需额外安装其他 skill。
- 安装:把整个目录放进 agent skills 目录(例如 ~/.agents/skills/ 或 ~/.claude/skills/):
git clone https://github.com/pyang5166/gbro-collage-broll.git ~/.agents/skills/gbro-collage-broll- 首次使用:触发 skill 时会自动运行 scripts/check_setup.sh 自检,针对缺失项给出配置指引;缺失依赖时按指引创建共享 venv ~/hyperframes-projects/.omni-venv/ 并安装 google-genai。
- 使用示例:对 agent 说 'collage b-roll:很多人以为 AI 是来替你思考的,其实它更像一面镜子,会把你问题里的漏洞照出来。' 或使用触发词 'collage b-roll'、'纸拼贴 b-roll'、'半调拼贴'、'拼贴风格配画面'、'gbro-collage-broll',然后按 Gate 1 → Gate 2 → Gate 3 逐步确认。批量给多句文稿也可以。
- 常见问题:错误的隐喻或静帧直接进视频生成会浪费 API 费用,所以强制两次人工确认;成片首帧边缘露出一点纸片可接受,严格空场需求建议用可编辑时间线的动画工具补前段;模型默认固定 gemini-omni-flash-preview,明确指定其他模型时才切换。
适用场景
Skill 讨论与实践反馈
0还没有讨论
分享一条可复现的补充、问题或使用经验。