通用大模型“跨界”搅局,AI视频赛道竞争格局生变

过去一个月,AI视频领域最引人注目的讨论并非来自Seedance、可灵等专业视频模型,而是来自“越界”闯入的通用大模型。Claude Opus 5.5与GPT-6 Astra分别以代码渲染和空间规划两条截然不同的路径切入视频生成赛道,悄然改写行业竞争逻辑。

9月22日,Anthropic发布Claude Opus 5.5,官方定位聚焦编程能力与Agent任务执行,视频并非发布重点。然而有开发者测试中意外爆发的视频生成能力,迅速催生了一种新的创作范式,即Vibe Video。该模型不直接输出像素画面,而是通过编写SVG、Canvas、Three.js、Remotion等前端代码逐帧定义视觉元素与运动轨迹,再经无头浏览器录制与FFmpeg编码合成MP4文件。X平台博主@anabology仅提供一段提示词和一份情绪板,模型便自主完成全流程制作,12小时输出一部电影质感短片,帖子浏览量突破2000万,马斯克多次转发并评论“真切感受到了AGI的深远影响”。推理初创公司Deedy使用该模型制作产品发布视频,单条生成耗时约1分钟,API成本仅约2美元,最终收获32万播放量。GitHub上的案例集合站已收录400多条作品,覆盖动效图形、知识讲解、3D场景等品类。

如果说Opus 5.5是从代码切入创意视频,GPT-6 Astra则将触角伸向了更上游的策划环节。9月3日发布的Astra,核心能力覆盖对Blender、Unreal Engine等三维创作软件的操作,扮演“导演+制片”角色:先完成创意规划、空间设计与镜头调度,再交由Seedance 2.5等专业视频模型渲染成片。Higgsfield AI的测试显示,Astra先在Blender中搭建白模场景、规划运镜路线,确认空间逻辑后交给视频模型渲染,有效缓解了AI视频长期存在的空间错乱和镜头穿模问题。与此同时,国内创作者已摸索出本土化工作流,仙侠剧本交由Astra拆解分镜后对接Seedance 2.5生成90秒成片,整套流程约两小时,成本折合人民币仅150元。

两条跨界路径正在重构AI视频行业的利益分配。一方面,产品宣传片、知识科普等内容开始被低成本的代码路线分流;另一方面,GPT-6 Astra开始掌握视频生成的分工主导权,将专业视频模型降格为下游渲染工序,长期或将压低其在产业链上的价值。

面对冲击,专业视频模型厂商正加速向上游创作环节延伸。9月20日,剪映推出“剪映Hub”创作工作台和“剪映助手”智能体,结合此前的小云雀Agent和漫剧创作工具,字节已搭建起“底层模型+垂直场景Agent+通用创作工作台”的完整生态。MiniMax于7月发布视频模型H3后,不到三周便上线创作Agent工作台MiniMax Design,由主Agent拆解需求、调度多智能体并行完成从脚本到成片的全流程。快手则采取双轨策略:可灵AI 4.0补齐30秒原生时长、4K HDR等关键参数,创作Agent工具ikli同步内测,主打从需求理解到配音剪辑的全流程制作。

而随着通用大模型与专业视频模型的边界逐渐的模糊,未来的胜负手不在于参数高低,而在于谁能更深地融入真实的创作生产流程,成为创作者离不开的生产工具。