
01
多角色短剧
Seed Audio 2.0 可以在一条里保住几个人,再把雨声、脚步和点题音留在各自轨道上,方便剪辑单独推拉。
Seed Audio 2.0 面向 T2A、TA2A、TV2A、TAV2A。一条指令可以覆盖约六分钟、六段参考声、三十种语言,并把对白、音乐、环境声和音效拆成独立分轨。现在先锁定积分。页面生成器仍运行 Seed Audio 1.0,方便你在 Seed Audio 2.0 上线前把提示词练熟。
Seed Audio 2.0 场景台
示例简报

Seed Audio 2.0 简报:舰长、工程师和领航员在警报升高、引擎轰鸣、弦乐收紧时争论撞击倒计时。
模型列表里能看到 Seed Audio 2.0,并带 Coming Soon 标签。真正出声仍走 Seed Audio 1.0,方便你先测积分、参考和场景简报。账号不用换;等 Seed Audio 2.0 打开时,早鸟订单会落在同一账户。
模型
输入
以提示词为核心,可选更多生成控制。
更多设置
展开后可调整更多输入控制。
历史记录
你的 Seed Audio 1.0 Preview 最近生成记录。
登录后可查看生成历史。
使用方法
把今天的生成器当成 Seed Audio 2.0 的彩排室。写场景、挂上已有参考、设好额度,再听。等 Seed Audio 2.0 上线,同一套简报习惯应该能直接带走:更长时长、更多人声、视频上下文,以及分轨而不是一条混缩。

写清谁在说话、站在哪、房间在做什么、哪一个点必须落地。这就是 Seed Audio 2.0 被要求在更长时长里跟上的简报方式。

今天工作室能挂的床比 Seed Audio 2.0 少。还是把关键人声传上去,提示词里点名的方式和上线后保持一致。

设好格式、速度和积分上限。Seed Audio 2.0 会跑更长任务;现在用便宜草稿把习惯练老实。

听叠字、音乐盖过人声、拟音来晚了。这些正是 Seed Audio 2.0 分轨和时间戳想减少的返工。
Seed Audio 2.0 简报
模式 + 时长 + 说话人 + 语言 + 画面或人声参考 + 分轨意图 + 带时间戳的事件。
上线之后
Seed Audio 2.0 不是更长的 TTS。它是场景渲染器:看画面配音、更多参考声、能直接上时间线的分轨。下面四块是制作人在等 Seed Audio 2.0 时最常提起的活。

01
Seed Audio 2.0 可以在一条里保住几个人,再把雨声、脚步和点题音留在各自轨道上,方便剪辑单独推拉。

02
丢进画面,可选再加人声床。Seed Audio 2.0 被设计成跟着动作、剪辑和节奏走,而不是在无声画面下平铺旁白。

03
Boss 台词、森林循环和 UI 点击可以写在同一份 Seed Audio 2.0 简报里,再拆轨,避免游戏混音师去“解烤”立体声。

04
三段人声的汽车广告可以把口播、引擎、城市底噪和钩子留在 Seed Audio 2.0 的不同分轨上,方便换市场和法务重剪。
落地场景
这是制作任务,不是情绪板。Seed Audio 2.0 面向已经在剪画面、做本地化或出交互世界、并且需要声音以可编辑分轨交到手里的人。如果只要一个旁白,在 Seed Audio 2.0 上线前,Seed Audio 1.0 或语音引擎可能仍更简单。
Seed Audio 2.0 针对多场次短片:人声、铺底和点题音要在镜头之间保持角色,而不是靠素材库重新拼。
当一条片子需要口播、产品拟音和音乐抬升一次生成,再为各市场拆分轨时,用 Seed Audio 2.0。
角色呼喊、循环和环境点可以一起写简报。Seed Audio 2.0 分轨给音频负责人的是更接近工程文件的东西,而不是预告片混缩。
三十语种加上视频上下文,是 Seed Audio 2.0 给那些现在还在逐市场重录的团队的卖点。
六分钟仍是一章,不是一整季,但够一支播客开场或漫剧一幕;这是 Seed Audio 1.0 单次扛不住的长度。
六段参考声让 Seed Audio 2.0 把卡司分开,而不是把所有人压成两种库存音色。
模型要点
下面是已公布的 Seed Audio 2.0 相对你今天能跑的 1.0 工作室的增量:更长时间、更多参考、画面输入、分轨、更紧的点、更宽的语言。这是制作规格,不是口号表。
Seed Audio 2.0 面向 T2A、TA2A、TV2A、TAV2A,任务可以从文本、人声床、画面或三者一起开始。
Seed Audio 2.0 把参考从大约三段提到六段,一场里有主角、对手戏和群感时才够用。
TV2A 和 TAV2A 让 Seed Audio 2.0 读动作和节奏,而不是在静音时间线下猜配乐。
对白、音乐、环境声和音效可以以 Seed Audio 2.0 分轨离开,而不是一条粘死的混音。
Seed Audio 2.0 强调更精确的事件落点,门响或接词可以坐在标好的拍点上。
Seed Audio 2.0 扩大语言覆盖,方便配音和本地化漫剧,而不用整条混音推倒重来。
版本差
Seed Audio 1.0 是你今天在这里能生成的模型。Seed Audio 2.0 是即将到来的即梦规格:更长任务、更多参考、视频输入、分轨和更宽语言。把这张表当简报,而不是当成这个工作室里已经有全部 2.0 控件的承诺。
| 维度 | Seed Audio 1.0(2026 年 7 月) | Seed Audio 2.0(Dreamina 当前规格) |
|---|---|---|
| 最大时长 | 约 2 分钟 | 最长 6 分钟 |
| 参考音频数量 | 最多约 3 段 | 最多 6 段 |
| 输入方式 | 文本 + 参考音频(+ 可选图片) | 文本 + 参考音频 + 参考视频(支持 T2A / TA2A / TV2A / TAV2A) |
| 语言支持 | 20+ 语种 | 30 语种 |
| 多轨与时间控制 | 基础时间线控制(对白精度约 100ms) | 独立多轨生成(对白、音乐、环境声、音效分开)+ 精确时间戳控制 |
| 核心能力 | 端到端场景生成(对白 + 音效 + 环境声 + 音乐) | 在 1.0 基础上强化:更强可控声音克隆、情感/节奏/风格控制、视频上下文感知配音、跨场景声音一致性 |
| 适用场景 | 短场景、基础声音创作 | 长音频、短剧、广告、游戏、多语言本地化、复杂多角色场景 |
Seed Audio 2.0 还不能在这个生成器里当免费升级用。想在模型打开时有额度,现在下早鸟单;草稿仍用 Seed Audio 1.0。
锁定早鸟价价格
按需购买一次性积分包,适合测试、个人创作和更高用量的 AI 音频生成。所有付费订阅和积分包均包含 Seed Audio 1.0 API 调用权限,网页版与 API 共用同一积分余额。
无需订阅,小额积分包适合先试用。
适合偶尔做内容项目的灵活积分包。
适合不订阅但需要较高用量的一次性积分包。
现场笔记
这些是预告片剪辑、本地化制片和游戏音频的综合笔记,写成工作备忘,不是五星墙。没有人假装 Seed Audio 2.0 已经在本站出声。
我买积分是因为六分钟分轨能省掉一周末的临时配音。Seed Audio 2.0 没开之前,我还是用 1.0 看提示词到底通不通。
我在意的只有视频转音频。如果 Seed Audio 2.0 能跟着剪辑走而不是无视画面,我们就不必再把英语口播垫在已经有口型的画面下面。
我不需要又一个魔法声音。我需要 Seed Audio 2.0 让女主在三集里停在同一条床上。克隆要是还漂,我们就继续实录。
六段参考是我能跟制片讲清楚的升级。三段一直很挤。等我能单独听雨声还不把台词掐死,我才信 Seed Audio 2.0。
早鸟
Seed Audio 2.0 仍显示即将发布。现在下单保留早鸟价。新模型排队期间,你仍可在本页用 Seed Audio 1.0 生成。