从 SkyMusic 到 V9.5:模型版本沿革与关键升级一览
模型的迭代方向可以直接决定你的生成体验:老版本"能出声",新版本"能撑起一首完整的歌"。下面按官方品牌故事页整理的时间线回顾关键节点,方便判断自己的作品用的是哪一代能力。
版本时间线
| 版本 | 时间 | 代表性进展 |
|---|---|---|
| 1.0 | 2024 年 2 月 | 以 SkyMusic 测试版起步,打通旋律、编曲、人声与歌词的端到端链路 |
| 2.0 | 2024 年 4 月 | 中英双语版本上线,建立在线评测与验收机制 |
| 3.0 | 2024 年 6 月 | 大规模基座能力成型,为音质、结构与对齐打基础 |
| 4.0 | 2024 年 8 月 | 精筛数千万级数据、上线音频重建,听感与音质明显跃升 |
| 5.0 / 5.5 | 2024 年 11 月 | 新增四种语言,多语言多流派混合微调 |
| 6.0 | 2025 年 3 月 | MusiCoT 框架亮相,支持十种语言 |
| 7.0 / 7.5 | 2025 年 7 至 8 月 | 多尺度精细建模(和声、旋律、结构),强化学习系统化 |
| V7.6 与 O2 | 2025 年 11 月 | 面向大规模商业化,速度与稳定性并重 |
| V8 | 2026 年 1 月 | 发布时在第三方评测机构 Artificial Analysis 的人声与乐器两项测评中登顶 |
| V9 | 2026 年 3 月 | 强化分段级文本控制、混音质量与生成效率 |
| V9.5 | 2026 年 | 编曲、人声、情绪与描述意图协同更自然 |
MusiCoT 是什么
MusiCoT 指的是在真正合成音频之前,先形成可分析的音乐推理:主歌与副歌如何对比、和声如何支撑旋律、人声与歌词如何咬合、情绪如何随段落推进。这解释了为什么新模型生成的歌更有"整体结构",而不是碎片式的好听片段拼接。
V9.5 的官方评测口径
官方品牌故事页公布的同标准 100 首评测中,V9.5 的人声通过率 61.0%、描述控制通过率 97.0%、全流派表达率 95.7%、音频健康率 84.0%、整体可用率 28.0%。这些数字描述的是特定评测样本,不代表每首歌的体验,但能看出版本方向:把你输入的流派、情绪、人声与配器要求,更稳定地落实为整首歌里的音乐选择。
提示:订阅用户可以在生成时选择 V9.5、V9、V8、O2 等高级模型;免费额度默认使用基础模型。功能与模型组合可能随版本调整,以官方最新版为准。