当硅谷转向「世界模型」,中国视频公司选择先把钱赚了丨对话 Sand.ai
当硅谷转向「世界模型」,中国视频公司选择先把钱赚了丨对话 Sand.ai
来源类型: AI视频行业访谈
日期: 2026-06-17
标签: Sand.ai, VidMuse, 世界模型, 视频生成, 音画同出, 多镜头叙事
核心论点
2026年视频模型赛道出现"中美分野":硅谷(OpenAI/Runway/Luma AI)转向"世界模型"叙事,弱化产品强化模型;中国公司(字节即梦/快手可灵)更重视视频生成商业价值,快速实现付费闭环。Sand.ai作为创业样本,选择"双轮驱动"路径(产品用最好模型找PMF,模型在关键环节换效果/成本/毛利),VidMuse主打"Music in, Video Out",ARR超千万美元。曹越认为中国视频模型能力已处世界第一梯队,音画同出和多镜头叙事是过去一年最关键突破。
关键事实
- 中美分野:硅谷弱化产品强化模型(OpenAI停Sora、Runway/Luma转向世界模型);中国快速商业化(Seedance/可灵付费闭环)
- VidMuse产品:Music in, Video Out(音乐驱动视频创作);ARR超千万美元(上线2个月);单周收入20+万美元;注册到付费转化5-7%
- 双轮驱动路径:产品先用最好模型跑PMF,模型在关键环节支持(提升效果/降低成本/提高毛利);创业公司更容易实现(founder mode对齐)
- 技术突破:音画同出(人物表演细腻/口型声音动作同步)、多镜头叙事(提升真实感/空间感)
- 音乐作为入口:音乐天然连接创作意愿(有音乐的人已有创作意愿);音频是比图片文字更适合的连续信息;音乐人/AI音乐人是核心用户
- 用户画像:音乐相关用户(Suno创作者补"从音乐到视频")、泛生活化创作(年会/生日/家庭纪念/情绪表达)
- 护城河:memory(长期记忆)+ 信任关系(稳定性/纠正幻觉);用户敢信才能建立长期关系
与已有知识的关联
- entities/Sand.ai — 核心公司
- entities/VidMuse — 核心产品
- entities/曹越 — Sand.ai创始人
- concepts/世界模型 — 硅谷视频模型转向方向
- concepts/音画同出 — 视频模型关键技术突破
- concepts/多镜头叙事 — 提升真实感的关键
- concepts/双轮驱动 — 产品+模型协同路径
资料来源
- 原文URL:https://mp.weixin.qq.com/s/1ETnm2CSUlxSbRIUdpVpew
- 原始文件路径:
raw/articles/微信文章3/当硅谷转向「世界模型」,中国视频公司选择先把钱赚了丨对话 Sand.ai.md - 作者:曹思颀(极客公园)
- 发布时间:2026-06-17
我的判断
置信度:高(创始人访谈,战略清晰)
预测(2026-2028):
1. 2027年视频模型商业化将超越语言模型,市场规模突破100亿美元
2. "Music in, Video Out"模式将在2027年被50%视频AI产品采用
3. 中国视频模型公司将在2027年占据全球市场60%份额
4. 音画同出+多镜头叙事将成为2027年视频模型标配能力
批处理信息:batch-2026-微信文章3,第19/108篇