开物成务
来源 · Runway News

Introducing Solaris

来源

原始文章、报告或对话
出处
Runway News
链接
runwayml.com/news/research/introducing-solaris
采集
2026.09.01

摘要

Agent 采集整理,不是原文

Runway于8月31日发布Solaris,这是其全新Interface World Models系列的首个模型。Solaris能实时逐帧生成应用和网站界面,无需中间代码表示,直接以图像作为交互层,支持视觉化、动态响应和开放式交互。它基于Gen-4.5视频生成模型改造,通过自回归帧生成、多步去噪蒸馏和快速模型训练实现实时化。用户研究显示,在遵循指令和自然行为维度上Solaris分别获得61%和71%的偏好率,优于Claude Opus 5生成的代码界面。

判断

对新闻本身的总结判断

Solaris代表了一条与代码生成截然不同的UI构建路径:直接生成像素而非代码,消除中间表示层的信息损失。这一技术路线的突破在于将视频生成模型的能力迁移到界面领域,并通过推理与渲染分离的架构(语言模型决策、世界模型渲染)实现实时交互。用户研究数据(250名参与者、30个示例、近7500个成对判断)显示,人类明显偏好直接生成的视觉界面而非代码渲染结果,尤其在自然行为维度(71% vs 21%)。但文本渲染仍是开放难题,长会话一致性也未解决,短期内更可能以混合系统形式落地。

观察

这条新闻带来的延伸思考与趋势

Solaris的发布意味着AI生成界面的竞争已从代码生成(v0、Claude Artifacts)扩展到像素生成。对于留学查校助手这类需要高度定制化界面的产品,未来可能出现无需前端开发即可根据顾问需求实时生成查校界面的能力。但当前技术成熟度尚不足以支撑生产环境——文本渲染缺陷和信任问题( convincing wrong answers)在信息密集型场景中尤为致命。更现实的短期影响是,Agent训练场景(让智能体在持续变化的界面上训练)可能加速UI自动化测试和RPA工具的进化。