正式研究卡深度层:原文讲什么 / 数据与方法 / 宣传与事实的边界 / 许可与时效
快速资料卡 · 先看这些广度层:每类挑给新手的第一站(首批 40 条,收录 2026-07-23)
8GB 本地路线的主外壳,工作流可保存、分享、局部重跑
- 8GB 路线的主要外壳,优先用官方模板
- 工作流本质是数据图,调试从上游到下游逐节点查
- 保存 workflow JSON 即可完整复现一次生成
- 第一次成功前不要安装第三方节点
适合想在本地跑通第一条视频的人
⚠ 过早堆自定义节点会让失败无法定位
6GB 显存即可图生视频,消费级显卡长视频方案代表
- 固定长度上下文逐段生成,能较早看到出帧
- 官方限定 RTX 30/40/50 且 Windows/Linux
- 一张首帧做 5–10 秒轻动作起步最稳
- 长视频生成慢,内容仍会漂移
适合8GB NVIDIA 用户的第一条本地视频
⚠ 有假冒同名网站,只从官方 GitHub 下载
Runway Prompting Guide官方资料把主体、动作、镜头写成结构化提示的通用基本功
- 从主体、环境、动作、镜头到风格建立提示结构
- 图生视频主要描述运动,别复述首帧
- 官方另有 92 条提示实例可反向拆解
- 新手优先阅读第 2 篇
适合所有平台通用的提示词入门
即梦实战前必读:多模态参考,而非只用一张首帧
- 图、视频、音频参考统一角色、动作与镜头
- 含编辑/延长能力与边界的官方说明
- 重点看输入材料,不只看成片
适合用即梦/Seedance 前的必读
解释为何单镜头漂亮、拼起来仍别扭的核心材料
- 讲时间/空间连续、视线、动作匹配
- 新手优先阅读第 1 篇
- AI 只负责素材,镜头关系和节奏仍由剪辑决定
适合所有开始拼多镜头的新手
8GB 显卡第一条本地视频的首选官方模板
- 含 5B T2V/I2V、14B 与首尾帧 FLF2V 模板
- 官方明确 5B 配合卸载适配 8GB
- 首尾帧流程可精确约束动作落点与转场
适合8GB 用户的本地第一试验项
教你把成功流程炼成 Skill:锁定不变量、换素材测试
- 可从成品、Board 流程或工作流文档提炼 Skill
- 原则:什么永不变、什么用户提供、什么可变
- 保存前必须用新素材测试
- 比存一次成功提示词更接近可靠 Skill
适合想沉淀自己的可复用流程
官方资料6 条
安装到第一个工作流的官方总入口,少走弯路的起点
- 覆盖安装、节点、模板与自定义节点
- 视频教程区含 Wan 系列与视频放大官方工作流
- 原则:先复现官方模板,再加自定义节点
适合本地生成的第一站
官方讲清文字/图像到视频与迭代的具体步骤
- 覆盖文字/图像到视频及继续迭代的操作
- 配套「支持功能」页可查各模型当前能力
- 模型更新快,操作以官方页为准而非旧教程
适合用 Flow/Veo 做多镜头创作
少有的中文官方提示词文档,格式直接可抄
- 把主体、运动、镜头、光影、风格写成可执行提示
- 与 Runway 指南对照可提炼跨平台共性
适合中文用户写视频提示词
Dream Machine 官方入门,项目到关键帧生成一条龙
- 覆盖项目、提示、关键帧与生成的操作流
- Learning Center 另有受控修改等进阶教程
适合第一次打开 Dream Machine
用代码而非 UI 跑视频生成,理解参数的最短路径
- Hugging Face 官方教程,覆盖主流开源视频模型
- 适合理解步数、种子、分辨率等核心生成参数
适合会 Python、想代码化实验的人
自建 Skill 的规范基线,格式、实践、评估都在这
- Quickstart 从最小 SKILL.md 到验证测试
- 评估方法:用任务+期望行为测,不凭感觉
- 先做只读「镜头卡检查 Skill」练手最稳
适合想自建视频 Skill 的人
幕后教程6 条
系统的景别、角度、构图词典,写分镜时随手查
- 覆盖景别、角度、构图与镜头功能
- 当分镜词典查阅,不必通读背诵
适合写镜头卡、分镜时查阅
官方拆解实拍+AI 混合制作,概念图如何定义全片风格
- 真人拍摄+Gemini/Imagen/Veo+3D 动作预演+VFX
- 概念图定风格、动作参考控摄影机是关键手法
- 佐证:优秀实践多为 AI+传统混合流程
适合想理解专业级混合制作流程
Dear Upstairs Neighbors 幕后幕后教程解决角色漂移的最高价值案例:规则+粗 3D+V2V
- 用角色设计规则与定制风格锁定轮廓
- 粗 3D 动画做表演预演,再视频转视频保稳定
- 角色稳定问题的高价值官方案例
适合角色一致性卡壳时看
看创作者如何顺着模型的超现实特性设计作品
- 收录 shy kids《Air Head》等早期创作者短片
- 思路:不对抗模型缺陷,顺势做超现实叙事
- 作为历史案例阅读
适合找创意方向、研究扬长避短
官方电影节获奖页,看叙事如何压过技术炫技
- Grand Prix 靠人物性格与喜剧节奏取胜
- 《THE WELL》示范悬疑片的信息控制
- 配 Screening Room 可对比历届审美演变
适合建立 AI 影像审美参照系
与视频 Agent 实验最直接相关:生成、评价、迭代闭环
- DeepLearning.AI+Google,约 1 小时 24 分
- 讲 LLM judge、结构化评分与跨场景一致性
- 自动评分只辅助,采用镜头仍人工定
适合想把生成-评价流程自动化
⚠ 评分作业/证书为 PRO,API 调用可能收费
开源项目11 条
5B 版是 8GB 显存本地生成最有现实依据的入口
- 含 5B 混合 T2V/I2V 与 14B 两档模型
- 5B 配 ComfyUI 原生显存卸载可进 8GB
- 官方模板还含首尾帧 FLF2V,可约束镜头起止
- 仓库演示可用来建立本地模型质量预期
适合8GB 显卡想跑本地文/图生视频
量化+卸载+蒸馏把大模型压进低显存,8GB 进阶首选
- 官方称 8GB 显存+16GB 内存可跑部分 14B 流程
- 量化省显存损画质,卸载省显存增耗时,需取舍
- 同一首帧做精度/步数严格 A/B 才知道值不值
适合愿意折腾参数的进阶玩家
⚠ 安装配置复杂,勿照抄来源不明的一键包
主打生成速度与镜头控制,官方三种用法生态完整
- 官方提供 CLI、ComfyUI 节点、桌面版三条路径
- 有官方 Quick Start,含安装与模型下载
- 8GB 不作为默认路线
适合显存充裕、看重速度与控制的人
⚠ 安装前先读官方硬件要求
腾讯混元官方开源,了解国产开源第一梯队的水位
- 官方提供推理代码与 ComfyUI 配套资料
- 通常高于 8GB 舒适区,先作研究资料
- 适合放进「自己训练/研究模型」路线
适合硬件充裕或做模型研究的人
⚠ 8GB 显卡别指望舒畅运行
统一生成与编辑,教你判断何时改旧镜头优于重生成
- 统一参考生视频、V2V、遮罩编辑、扩画、局部替换
- UserGuide 教按 T2V/R2V/V2V 选输入与预处理
- 项目页案例覆盖移动、替换、扩展等编辑玩法
适合进阶理解生成与编辑统一控制
专攻角色跨镜头一致性,画廊直观展示身份如何继承
- 研究跨画格/镜头的角色一致叙事
- 画廊适合专门观察脸、服装、身份特征继承
- 「角色为何漂移」的必看项目之一
适合被角色漂移困扰的创作者
React 代码写视频,同一数据可确定性重复渲染
- 用 React/CSS/SVG/Canvas/WebGL 渲染成 MP4
- 适合字幕、图表、模板化批量成片
- 不是生成式模型,走确定性渲染路线
适合会前端、要做标准化批量视频
⚠ 商业使用需核对其专有许可证
主题进成片出,认识「另一条成片路径」的最好样本
- 链路:文案→免版权素材→TTS→字幕→合成
- 本质是素材编排,不是 AI 生成电影镜头
- GPU 非硬性要求,8GB 机器可运行
适合做批量解说、无脸社媒短视频
⚠ 画面靠库存素材,别当电影工具用
看多 Agent 如何组织视频编辑:意图解析到反馈修正
- 意图分解→图式规划→30+ 编辑 Agent→反馈修正
- README 标 8GB GPU,但还需本地模型与云端 LLM
- 研究价值高,离稳定个人生产仍有工程距离
适合研究 Agentic 视频编辑架构
⚠ 8GB 只是起点,API 配置与成本别低估
一切自动化后期的最终执行器,合成渲染都在这层落地
- 归一化、拼接、定格、转场、调色、混音、编码全覆盖
- 自动化后期主执行器,可配 OpenTimelineIO
- 核心多为 LGPL,启用 GPL 组件则整体适用 GPL
适合想把剪辑合成步骤脚本化的人
⚠ 许可证随构建选项变化,商用需记录构建方式
阿里开源多语种 TTS 与克隆,短剧解说配音开源底座
- 提供推理、训练、部署全套能力
- 推荐组合:FunASR 转录 + CosyVoice 配音
适合需要中文配音底座的短剧/解说
⚠ 克隆真人声音必须先取得授权
工作流4 条
把参考动作、深度结构带入生成,表演运镜可控性大增
- 支持姿态/深度/结构视频作为控制输入
- 比纯文字描述动作精细得多
适合需要精确控制人物动作时
角色图+音频直接生成表演,对白唱歌镜头的本地方案
- 输入静态角色图与音频,输出表演视频
- 面向对白、演唱、表演三类场景
适合做角色对白、演唱镜头
讲透 ingredients 复用:同一角色场景贯穿多镜头
- 核心机制:可复用素材+从场景图启动新镜头
- 含《Electric Pink》等短片与创作者访谈
- 看点:同一角色/场景 ingredients 如何复用
适合理解云端多镜头连续创作
表格到多平台发布的全自动流水线完整参考
- 链路:表格→图像→I2V→配音字幕→合成→发布
- 自动发布涉及账号,不宜早期练习
适合已跑通手工流程、想批量化的人
⚠ 依赖多个外部付费服务,成本先算清
Skills6 条
Anthropic Skills 仓库Skills学复杂 Skill 怎么拆 scripts/references/assets 的范本
- 官方示例+模板,可看到完整文件结构
- 许多示例 Apache-2.0,但部分仅 source-available
- 不能把整个仓库统一当 Apache-2.0
适合写第一个正式 Skill 前参考
⚠ 许可证按目录不同,复用前逐个核对
平台官方 Skill,复杂类型化创作任务的调用范本
- 覆盖 T2I/T2V/I2V、续写、风格迁移与类型任务
- SKILL.md 公开可审,是学平台型 Skill 的样本
- 通过会话、上传、查询、下载调用平台能力
适合用 LibTV 做类型化视频
官方 30+ 规则文件,让编码 Agent 按规范写视频工程
- 规则覆盖动画、字幕、音频、3D、图表与渲染
- 适合程序化动画、批量模板场景
适合让 Agent 生成代码化视频
数字人口播与翻译本地化的官方 Skill,脚本直达成片
- 含 avatar、video、translate 三类官方 Skill
- Skill 会先补齐脚本与头像信息再调用管线
适合做数字人口播、视频翻译
⚠ 真人肖像与声音使用前必须确认授权
AI Video Storyboard SkillSkillsbrief 直出统一主题+逐镜规划,MIT 许可可放心改
- 输出视觉主题、6–18 镜头、提示与后期清单
- 示例覆盖 TikTok/Reels/广告/产品解说
- MIT 许可,社区 Skill 里许可最干净一档
适合做广告、社媒多镜头规划
chengfeng-videocut-skillsSkills中文口播后期全链,以审核页保留人工确认是最大亮点
- 转录→审核粗剪→字幕→分镜页→竖屏导出
- 中间审核页保留人工确认,不盲目全自动
- README 本身就是完整中文教程
适合中文口播、教程类视频后期