资料库:每条都有本站提炼

收录底线:每条有可打开的原文链接、来源状态与核验日期;回答「原文讲什么、为什么值得读、有什么限制」,不是网址加一句话;历史资料不伪装成当前能力,公司自评不伪装成第三方结论。

正式研究卡深度层:原文讲什么 / 数据与方法 / 宣传与事实的边界 / 许可与时效

🔍 AI 帮我查说你的情况和目标,AI 检索站内资料,给你带引用的总结报告(站内 2 积分/次)。

快速资料卡 · 先看这些广度层:每类挑给新手的第一站(首批 40 条,收录 2026-07-23)

ComfyUI开源项目

8GB 本地路线的主外壳,工作流可保存、分享、局部重跑

  • 8GB 路线的主要外壳,优先用官方模板
  • 工作流本质是数据图,调试从上游到下游逐节点查
  • 保存 workflow JSON 即可完整复现一次生成
  • 第一次成功前不要安装第三方节点
适合想在本地跑通第一条视频的人
过早堆自定义节点会让失败无法定位
FramePack开源项目

6GB 显存即可图生视频,消费级显卡长视频方案代表

  • 固定长度上下文逐段生成,能较早看到出帧
  • 官方限定 RTX 30/40/50 且 Windows/Linux
  • 一张首帧做 5–10 秒轻动作起步最稳
  • 长视频生成慢,内容仍会漂移
适合8GB NVIDIA 用户的第一条本地视频
有假冒同名网站,只从官方 GitHub 下载
Runway Prompting Guide官方资料

把主体、动作、镜头写成结构化提示的通用基本功

  • 从主体、环境、动作、镜头到风格建立提示结构
  • 图生视频主要描述运动,别复述首帧
  • 官方另有 92 条提示实例可反向拆解
  • 新手优先阅读第 2 篇
适合所有平台通用的提示词入门
Seedance 2.0 发布文章官方资料

即梦实战前必读:多模态参考,而非只用一张首帧

  • 图、视频、音频参考统一角色、动作与镜头
  • 含编辑/延长能力与边界的官方说明
  • 重点看输入材料,不只看成片
适合用即梦/Seedance 前的必读
连续性剪辑入门幕后教程

解释为何单镜头漂亮、拼起来仍别扭的核心材料

  • 讲时间/空间连续、视线、动作匹配
  • 新手优先阅读第 1 篇
  • AI 只负责素材,镜头关系和节奏仍由剪辑决定
适合所有开始拼多镜头的新手
Wan2.2 官方工作流工作流

8GB 显卡第一条本地视频的首选官方模板

  • 含 5B T2V/I2V、14B 与首尾帧 FLF2V 模板
  • 官方明确 5B 配合卸载适配 8GB
  • 首尾帧流程可精确约束动作落点与转场
适合8GB 用户的本地第一试验项
Luma 创建 Skills 教程Skills

教你把成功流程炼成 Skill:锁定不变量、换素材测试

  • 可从成品、Board 流程或工作流文档提炼 Skill
  • 原则:什么永不变、什么用户提供、什么可变
  • 保存前必须用新素材测试
  • 比存一次成功提示词更接近可靠 Skill
适合想沉淀自己的可复用流程

官方资料6

ComfyUI 官方文档官方资料

安装到第一个工作流的官方总入口,少走弯路的起点

  • 覆盖安装、节点、模板与自定义节点
  • 视频教程区含 Wan 系列与视频放大官方工作流
  • 原则:先复现官方模板,再加自定义节点
适合本地生成的第一站
Google Flow 官方帮助官方资料

官方讲清文字/图像到视频与迭代的具体步骤

  • 覆盖文字/图像到视频及继续迭代的操作
  • 配套「支持功能」页可查各模型当前能力
  • 模型更新快,操作以官方页为准而非旧教程
适合用 Flow/Veo 做多镜头创作
火山引擎视频提示词指南官方资料

少有的中文官方提示词文档,格式直接可抄

  • 把主体、运动、镜头、光影、风格写成可执行提示
  • 与 Runway 指南对照可提炼跨平台共性
适合中文用户写视频提示词
Luma 快速入门官方资料

Dream Machine 官方入门,项目到关键帧生成一条龙

  • 覆盖项目、提示、关键帧与生成的操作流
  • Learning Center 另有受控修改等进阶教程
适合第一次打开 Dream Machine
Diffusers 视频生成文档官方资料

用代码而非 UI 跑视频生成,理解参数的最短路径

  • Hugging Face 官方教程,覆盖主流开源视频模型
  • 适合理解步数、种子、分辨率等核心生成参数
适合会 Python、想代码化实验的人
Agent Skills 官方文档官方资料

自建 Skill 的规范基线,格式、实践、评估都在这

  • Quickstart 从最小 SKILL.md 到验证测试
  • 评估方法:用任务+期望行为测,不凭感觉
  • 先做只读「镜头卡检查 Skill」练手最稳
适合想自建视频 Skill 的人

幕后教程6

镜头景别完全指南幕后教程

系统的景别、角度、构图词典,写分镜时随手查

  • 覆盖景别、角度、构图与镜头功能
  • 当分镜词典查阅,不必通读背诵
适合写镜头卡、分镜时查阅
ANCESTRA 幕后幕后教程

官方拆解实拍+AI 混合制作,概念图如何定义全片风格

  • 真人拍摄+Gemini/Imagen/Veo+3D 动作预演+VFX
  • 概念图定风格、动作参考控摄影机是关键手法
  • 佐证:优秀实践多为 AI+传统混合流程
适合想理解专业级混合制作流程
Dear Upstairs Neighbors 幕后幕后教程

解决角色漂移的最高价值案例:规则+粗 3D+V2V

  • 用角色设计规则与定制风格锁定轮廓
  • 粗 3D 动画做表演预演,再视频转视频保稳定
  • 角色稳定问题的高价值官方案例
适合角色一致性卡壳时看
Sora 创作者首批实验幕后教程

看创作者如何顺着模型的超现实特性设计作品

  • 收录 shy kids《Air Head》等早期创作者短片
  • 思路:不对抗模型缺陷,顺势做超现实叙事
  • 作为历史案例阅读
适合找创意方向、研究扬长避短
Runway AIF 获奖作品幕后教程

官方电影节获奖页,看叙事如何压过技术炫技

  • Grand Prix 靠人物性格与喜剧节奏取胜
  • 《THE WELL》示范悬疑片的信息控制
  • 配 Screening Room 可对比历届审美演变
适合建立 AI 影像审美参照系
AI 图像视频 Agent 课程幕后教程

与视频 Agent 实验最直接相关:生成、评价、迭代闭环

  • DeepLearning.AI+Google,约 1 小时 24 分
  • 讲 LLM judge、结构化评分与跨场景一致性
  • 自动评分只辅助,采用镜头仍人工定
适合想把生成-评价流程自动化
评分作业/证书为 PRO,API 调用可能收费

开源项目11

Wan2.2开源项目

5B 版是 8GB 显存本地生成最有现实依据的入口

  • 含 5B 混合 T2V/I2V 与 14B 两档模型
  • 5B 配 ComfyUI 原生显存卸载可进 8GB
  • 官方模板还含首尾帧 FLF2V,可约束镜头起止
  • 仓库演示可用来建立本地模型质量预期
适合8GB 显卡想跑本地文/图生视频
LightX2V开源项目

量化+卸载+蒸馏把大模型压进低显存,8GB 进阶首选

  • 官方称 8GB 显存+16GB 内存可跑部分 14B 流程
  • 量化省显存损画质,卸载省显存增耗时,需取舍
  • 同一首帧做精度/步数严格 A/B 才知道值不值
适合愿意折腾参数的进阶玩家
安装配置复杂,勿照抄来源不明的一键包
LTX-Video开源项目

主打生成速度与镜头控制,官方三种用法生态完整

  • 官方提供 CLI、ComfyUI 节点、桌面版三条路径
  • 有官方 Quick Start,含安装与模型下载
  • 8GB 不作为默认路线
适合显存充裕、看重速度与控制的人
安装前先读官方硬件要求
HunyuanVideo-1.5开源项目

腾讯混元官方开源,了解国产开源第一梯队的水位

  • 官方提供推理代码与 ComfyUI 配套资料
  • 通常高于 8GB 舒适区,先作研究资料
  • 适合放进「自己训练/研究模型」路线
适合硬件充裕或做模型研究的人
8GB 显卡别指望舒畅运行
VACE开源项目

统一生成与编辑,教你判断何时改旧镜头优于重生成

  • 统一参考生视频、V2V、遮罩编辑、扩画、局部替换
  • UserGuide 教按 T2V/R2V/V2V 选输入与预处理
  • 项目页案例覆盖移动、替换、扩展等编辑玩法
适合进阶理解生成与编辑统一控制
StoryDiffusion开源项目

专攻角色跨镜头一致性,画廊直观展示身份如何继承

  • 研究跨画格/镜头的角色一致叙事
  • 画廊适合专门观察脸、服装、身份特征继承
  • 「角色为何漂移」的必看项目之一
适合被角色漂移困扰的创作者
Remotion开源项目

React 代码写视频,同一数据可确定性重复渲染

  • 用 React/CSS/SVG/Canvas/WebGL 渲染成 MP4
  • 适合字幕、图表、模板化批量成片
  • 不是生成式模型,走确定性渲染路线
适合会前端、要做标准化批量视频
商业使用需核对其专有许可证
MoneyPrinterTurbo开源项目

主题进成片出,认识「另一条成片路径」的最好样本

  • 链路:文案→免版权素材→TTS→字幕→合成
  • 本质是素材编排,不是 AI 生成电影镜头
  • GPU 非硬性要求,8GB 机器可运行
适合做批量解说、无脸社媒短视频
画面靠库存素材,别当电影工具用
VideoAgent开源项目

看多 Agent 如何组织视频编辑:意图解析到反馈修正

  • 意图分解→图式规划→30+ 编辑 Agent→反馈修正
  • README 标 8GB GPU,但还需本地模型与云端 LLM
  • 研究价值高,离稳定个人生产仍有工程距离
适合研究 Agentic 视频编辑架构
8GB 只是起点,API 配置与成本别低估
FFmpeg开源项目

一切自动化后期的最终执行器,合成渲染都在这层落地

  • 归一化、拼接、定格、转场、调色、混音、编码全覆盖
  • 自动化后期主执行器,可配 OpenTimelineIO
  • 核心多为 LGPL,启用 GPL 组件则整体适用 GPL
适合想把剪辑合成步骤脚本化的人
许可证随构建选项变化,商用需记录构建方式
CosyVoice开源项目

阿里开源多语种 TTS 与克隆,短剧解说配音开源底座

  • 提供推理、训练、部署全套能力
  • 推荐组合:FunASR 转录 + CosyVoice 配音
适合需要中文配音底座的短剧/解说
克隆真人声音必须先取得授权

工作流4

Wan Fun Control工作流

把参考动作、深度结构带入生成,表演运镜可控性大增

  • 支持姿态/深度/结构视频作为控制输入
  • 比纯文字描述动作精细得多
适合需要精确控制人物动作时
Wan2.2 S2V 音频驱动工作流

角色图+音频直接生成表演,对白唱歌镜头的本地方案

  • 输入静态角色图与音频,输出表演视频
  • 面向对白、演唱、表演三类场景
适合做角色对白、演唱镜头
Introducing Flow工作流

讲透 ingredients 复用:同一角色场景贯穿多镜头

  • 核心机制:可复用素材+从场景图启动新镜头
  • 含《Electric Pink》等短片与创作者访谈
  • 看点:同一角色/场景 ingredients 如何复用
适合理解云端多镜头连续创作
n8n 视频自动化模板工作流

表格到多平台发布的全自动流水线完整参考

  • 链路:表格→图像→I2V→配音字幕→合成→发布
  • 自动发布涉及账号,不宜早期练习
适合已跑通手工流程、想批量化的人
依赖多个外部付费服务,成本先算清

Skills6

Anthropic Skills 仓库Skills

学复杂 Skill 怎么拆 scripts/references/assets 的范本

  • 官方示例+模板,可看到完整文件结构
  • 许多示例 Apache-2.0,但部分仅 source-available
  • 不能把整个仓库统一当 Apache-2.0
适合写第一个正式 Skill 前参考
许可证按目录不同,复用前逐个核对
LibTV 官方 SkillsSkills

平台官方 Skill,复杂类型化创作任务的调用范本

  • 覆盖 T2I/T2V/I2V、续写、风格迁移与类型任务
  • SKILL.md 公开可审,是学平台型 Skill 的样本
  • 通过会话、上传、查询、下载调用平台能力
适合用 LibTV 做类型化视频
Remotion SkillsSkills

官方 30+ 规则文件,让编码 Agent 按规范写视频工程

  • 规则覆盖动画、字幕、音频、3D、图表与渲染
  • 适合程序化动画、批量模板场景
适合让 Agent 生成代码化视频
HeyGen SkillsSkills

数字人口播与翻译本地化的官方 Skill,脚本直达成片

  • 含 avatar、video、translate 三类官方 Skill
  • Skill 会先补齐脚本与头像信息再调用管线
适合做数字人口播、视频翻译
真人肖像与声音使用前必须确认授权
AI Video Storyboard SkillSkills

brief 直出统一主题+逐镜规划,MIT 许可可放心改

  • 输出视觉主题、6–18 镜头、提示与后期清单
  • 示例覆盖 TikTok/Reels/广告/产品解说
  • MIT 许可,社区 Skill 里许可最干净一档
适合做广告、社媒多镜头规划
chengfeng-videocut-skillsSkills

中文口播后期全链,以审核页保留人工确认是最大亮点

  • 转录→审核粗剪→字幕→分镜页→竖屏导出
  • 中间审核页保留人工确认,不盲目全自动
  • README 本身就是完整中文教程
适合中文口播、教程类视频后期