> 你有一个好故事,但不会画画、不会剪辑、不会建模。
> 比格熊帮你把「一句话创意」变成完整的分镜、视频、对白——全在同一台电脑上完成。
---
## 一句话说清楚
比格熊是一个 **装在你电脑上的 AI 导演工具**。
不是网页,不是在线白板,不是 API 聚合器。
是一个正儿八经的桌面软件——打开就能用,关了数据还在,断网也不怕。
---
## 它能帮你做什么?
### 🎬 从故事到成片,一条链走完
你只需要输入一个故事想法,比格熊会自动帮你:
1. **扩展成完整故事** — 角色、情节、冲突、转折,AI 帮你构思
2. **拆成剧集和场次** — 像真正的制片流程一样,把故事结构化
3. **生成分镜故事板** — 每个镜头都有景别、角度、运镜、角色走位
4. **批量生成图片和视频** — 对接即梦、可灵、通义万相、Seedance 等多家模型
5. **配音和字幕** — TTS 语音合成 + 唇形同步,角色能开口说话
6. **导出交付** — 视频片段、分镜图、剧本,随时导出
**从第一句话到最终成片,不用切换任何其他工具。**
### 🎭 角色是活的,不是一张图
在比格熊里,角色不是贴在白板上的一张图片。每个角色有自己的:
- **多角度定妆照** — 正面、侧面、3/4 视角,一次生成多张
- **体型与外貌设定** — 系统记住你的角色长什么样
- **跨场景一致性** — 换场次、换镜头,角色还是那个人
- **全局资产库** — 角色不绑死在一个故事里,跨项目复用
你设定好的角色,会贯穿整部作品的每一个镜头。
### 🖥️ 全部在你电脑上完成
比格熊是 **本地桌面软件**,这意味着:
- ✅ **数据在你手里** — 故事、剧本、素材全部存在你自己的电脑上
- ✅ **关掉不丢失** — 不像网页,关了浏览器还在
- ✅ **断网也能用** — 本地大模型(llama.cpp、Whisper)离线也能跑
- ✅ **隐私有保障** — 敏感剧本不会自动上传到任何地方
- ✅ **不绑账号** — 云端 AI 是可选的,不是必须的
### 🎨 你选什么模型,就用什么模型
比格熊对接了多家 AI 能力:
| 能力 | 可选模型 |
|------|----------|
| 文本生成 | OpenAI、本地 llama.cpp 等 |
| 图片生成 | 即梦、通义万相、ComfyUI 等 |
| 视频生成 | 即梦、可灵、Seedance、通义万相等 |
| 语音合成 | 多家 TTS + 本地方案 |
| 唇形同步 | Hedra、LivePortrait、MuseTalk 等 5 种 |
**关键是:你选了什么,系统就用什么。** 不会偷偷换通道,不会静默兜底。每一次生成,都明确对应你选定的模型。
---
## 为什么不是网页工具?
市面上有很多"AI 分镜"、"AI 故事板"的在线工具。它们能做的是:
> 你写一句话 → AI 出一张图 → 排在白板上 → 结束
比格熊做的是:
> 你写一句话 → 故事展开 → 剧集规划 → 场次拆解 → 分镜工程 → 批量生图/生视频 → 配音 → 成片
**白板给你一块布,比格熊给你一台机器。**
而且这台机器装在你电脑上,不依赖任何网站的存活。你的工程文件就是你的,拷到另一台电脑上照样打开。
---
## 技术上有多认真?
> 这一段给想深挖的朋友看。不想看技术细节?跳过就行,不影响你用。
### 🔌 全量模型接入:市面上主流 AI,一个不落
比格熊不是"只能用一两家模型"的小工具。它**全量接入**了当前市面上的主流 AI 能力:
| 能力 | 已接入模型 |
|------|-----------|
| 文本生成 | OpenAI、本地 llama.cpp 等 |
| 图片生成 | 即梦、通义万相、ComfyUI 等 |
| 视频生成 | 即梦、可灵、Seedance、通义万相等 |
| 语音合成 | 多家云端 TTS + 本地方案 |
| 唇形同步 | Hedra、LivePortrait、MuseTalk、Wav2Lip、可灵 — 5 种适配器 |
而且接入方式不是"能调 API 就行"。每家模型的接口都不一样,比格熊内部做了一层**统一端点注册表**——所有业务管线只认统一接口,厂商差异全部封装在底层。
这就像一个**万能插座**:不管你插的是国产电器还是进口电器,插座的形状是一样的。新增一家模型厂商,业务层零改动,注册一个新端点就完事。
更关键的是:**你选了什么模型,系统就用什么模型。** 不会偷偷换通道,不会静默兜底。没有适配过的模型宁可报错也不给你废图。
**今天能用的模型,明天全部能用。明天出来的模型,后天就能接上。**
### 🧩 高内聚,低耦合:改一块,不动其他
这是比格熊架构设计的核心哲学。用大白话说:
**高内聚** = 每个模块只管自己的事,把相关的功能紧紧聚在一起。
**低耦合** = 模块之间尽量不互相依赖,改一个不会牵连一大片。
在比格熊里,这句话体现在每一个层面:
**故事 → 剧集 → 场次 → 片段 → 分镜,每一层都是独立的。**
- 你改了一个片段的镜头,不会影响同一场次里其他片段
- 你重新规划了一集的场次,不会破坏已经画好的分镜
- 你换了一个角色的形象,所有引用该角色的地方自动更新,但故事结构纹丝不动
- 你删了一个场景,不会牵连到其他场景的素材
每个层级就像**乐高积木**——每块积木是完整的、独立的,但拼在一起就是一座城堡。你可以随时拆掉一块、换掉一块、加一块,城堡的其余部分稳如磐石。
**这不是"碰巧能用",是"设计成必须这样"。** 从第一天起,比格熊的数据结构、接口规范、模块边界就是按这个原则搭的。
### 🎯 四层分离:每一层只干自己的事
比格熊的后端不是一坨"什么都往里塞"的大杂烩。它分成清晰的四层:
- **领域层** — 只管"是什么":故事是什么、镜头是什么、角色是什么。纯粹的业务概念,不关心数据存在哪里、不关心怎么展示。
- **应用层** — 只管"做什么":生成一集分镜、提交一个视频任务、更新一段对白。编排业务流程,但不亲自干活。
- **基础设施层** — 只管"怎么存、怎么调":数据库怎么读写、云端 API 怎么对接、本地文件怎么管理。所有"外部世界"的细节都封装在这里。
- **组装层** — 把上面三层拼起来,让应用能跑起来。
四层分离意味着:**换一个数据库,业务逻辑不用改;换一家云服务商,存储层不用动;加一个新功能,只需要在对应的那一层加,不会牵一发动全身。**
这不是"凑合着分开",是**严格的单向依赖**——上层知道下层,下层不知道上层。就像一栋楼:三楼知道有二楼,但二楼不知道三楼长什么样。加一个四楼,二楼完全不受影响。
### 🏷️ 一个名字,全局统一:冻结词表
在很多软件里,同一个东西在数据库叫一个名字、在接口里叫另一个、在界面上又叫第三个——时间一长,谁也搞不清哪个是哪个。
比格熊从第一天起就锁定了**一套冻结词表**:故事、剧集、场次、片段——从数据库到接口到界面,**同一个概念只有一个名字**,全局统一,不可随意改动。
这不是洁癖,是**工程可靠性**的基石:改一个地方不会因为名字对不上而悄悄出 Bug。
### 🎬 双脑分镜:导演脑 + 工程脑
比格熊生成分镜不是"AI 随便画一张图"。每个镜头经过**两层大脑**处理:
- **导演脑(语义层)**——理解剧本,拆出镜头语言:景别、机位角度、运镜方式、角色走位、身体朝向、视线方向、对白模式……这些是影视工业几十年积累的专业概念,不是随机排列。
- **工程脑(渲染层)**——把导演语义翻译成画面可执行的结构化参数:构图锚点、头部空间、鼻前空间、纵深层次、光线方向、轴线规则……
两层分开的好处:导演语义可以反复调整,不用每次从头重画;工程参数可以批量替换,换一套渲染风格只需改工程脑,不用动导演脑。
**这不是"AI 帮你画画",是"AI 帮你当导演"。**
### 🎯 叙事保真协议(NFP):AI 帮你守规矩
比格熊内置了一套**结构化违规检查系统**。
每集剧本会自动对照 NFP 规则做逐条检查——戏剧弧位是否完整、冲突类型是否合理、节奏目标是否匹配、转场方式是否连贯。检查结果不是笼统的"写得不好",而是精确到**规则 ID + 违规依据 + 逐条列出**。
对话场景还有**自动质检**:必须有 master 镜、双方各有 OTS 和 reaction 镜——这是好莱坞几十年的覆盖拍摄规范,系统会自动检查并补全。
**AI 不只是帮你写故事,还帮你守规矩。**
### 🕸️ 通用有向图引擎:故事结构不是树,是网
传统的项目管理工具用"文件夹"组织内容——一层套一层,像树状目录。但故事不是这样的:角色跨集出场、场景跨章引用、镜头之间有因果和并行关系。
比格熊内置了一个**自研的通用有向图引擎**,用节点和连线来表达故事结构。每个节点可以连接任意多个其他节点,支持拓扑排序、连通性分析、环路检测。
而且这套引擎是**通用的**——分镜故事板、片段画布、Clips 片段管理——所有涉及"关系"的场景,共用同一套图引擎。**造一次,用五处。**
**故事是网状的,比格熊用网状的方式理解它。**
### ⚡ 自研画布内核:现在的性能,未来的想象
市面上的无限画布工具,拖几十张卡片就开始卡。比格熊的画布是**完全自研**的,不依赖任何第三方商业画布包:
- **虚拟渲染**——只处理屏幕上的内容,视野外的卡片不画
- **分批加载**——几百张图不会一次性涌入,按需加载
- **视野外降级**——视频、大图离开视野后自动释放资源,不白占内存
- **指针中心缩放**——以鼠标位置为中心缩放,手感一致不跳帧
而且这套画布内核是**通用的**——片段画布、分镜画布、角色画布、场景画布、参考图画布,五种画布共用同一套引擎。**改一处交互,五处同时受益。**
但这只是起点。因为画布内核是自研的,**没有天花板**。未来想在画布上加什么能力——多人实时协作、3D 预览、时间线轨道、音频波形可视化——只需要在自己的引擎上扩展,不用等第三方厂商更新,不用受别人的架构限制。
**自研引擎的好处不是"现在够用",是"未来想做什么就能做什么"。**
### 🤖 AI 任务队列:加一种能力,只写一个文件
比格熊的 AI 任务系统不是"调一个 API 等结果"那么简单。它有一套完整的**任务生命周期管理**:
- **状态机** — 每个任务有明确的状态流转:排队 → 执行中 → 成功/失败/取消
- **调度器** — 多个任务自动排队、并发控制、配额管理
- **持久化** — 任务记录落盘,关掉软件再打开,任务状态还在
- **事件总线** — 任务状态变化实时通知前端,进度条不是假的
最厉害的是**扩展方式**:已经支持 14 种不同的 AI 任务类型(文生图、图生图、视频生成、语音合成、唇形同步……),每种任务只需要注册一个 Handler,调度、排队、持久化、前端通知——全部自动生效。
**加一种新的 AI 能力,就像往书架上放一本新书——书架不用重建。**
### 🏗️ 41.6 万行,造的是机器
| 类别 | 规模 |
|------|------|
| 自研代码 | 41.6 万行,2642 个文件 |
| 后端模块 | 52 个独立模块,各司其职,互不侵入 |
| 前端组件 | 48 个顶层功能模块 |
| AI 任务类型 | 14 种,每种独立 Handler,新增即插即用 |
| 内部文档 | 730 篇设计规范、交互约定、故障排查手册 |
### 🔮 无限扩展空间:这才是真正的护城河
以上所有设计——全量模型接入、高内聚低耦合、四层分离、冻结词表、通用图引擎、自研画布——它们单独看是"技术亮点",**拼在一起才是真正的力量**。
因为这套架构,比格熊可以:
- **今天接 5 家模型,明天接 50 家** — 统一端点注册表,接一家只需注册一个端点
- **今天支持 14 种任务,明天支持 140 种** — 任务队列是插件式的,加一种只写一个 Handler
- **今天 5 种画布,明天 50 种** — 画布内核是通用的,新画布只管内容,不管交互
- **今天是一个人做,明天是一个团队做** — 四层分离 + 冻结词表,新人只需理解自己负责的那一层
- **今天是桌面端,明天可能是 Web 端或移动端** — 领域层和应用层不依赖任何具体的界面技术
**架构决定上限。比格熊的上限,远不止你现在看到的样子。**
**这不是一个周末项目。这是一个人、从零开始、持续迭代的正经生产软件。**
---
## 适合谁用?
- 🎬 **独立创作者** — 一个人也能产出完整的分镜和视频草稿
- 📹 **短视频团队** — 批量试制 AI 辅助前期,快速验证创意
- 🎓 **影视院校** — 学生在可控环境下练习分镜和导演思维
- 📖 **网文/漫画作者** — 把文字故事可视化,试拍"纸上电影"
- 🏢 **内容机构** — 数据不出域、操作可追溯、模型可审计
---
## 现在就试试
比格熊数字导演工作站,Windows 桌面客户端,本地安装,即开即用。
📦 下载地址:
https://pan.baidu.com/s/1URSWFhfrTS6kDQQH6q53iw?pwd=0000
https://pan.quark.cn/s/403c6fec8151
[bgxiong.com](https://www.bgxiong.com)
**你的故事。你的数据。你的选择。**
*41.6 万行自研代码,不是套壳,不是聚合器。是一个人从零开始造的机器。*
