云知声近日发布新一代主力模型U2-Flash,该模型采用稀疏MoE架构,总参数约266B,激活参数仅10B,最快输出速度达到300tokens/s,首字响应平均3秒以内。在Agent时代,U2-Flash致力于在能力、速度和成本之间寻找新的平衡,提升“智能密度”。
在评测方面,U2-Flash在DeepSWE v1.1中取得64.6分,较上一代翻倍;在SWE-Bench Pro中取得61.6分,提升10.5分;在TerminalBench 3.0中得分达24.3分。
智东西对U2-Flash进行了多方位实测,验证其在长链路Agent、编程和办公任务中的表现:
一、18分钟速搓Agent与WebUI封装
智东西要求U2-Flash通过阅读开源Agent框架Pi的代码仓库,创建一个名为Goat的新Agent并推送到GitHub。U2-Flash仅用18分钟便完成代码阅读、环境配置及Agent构建,并自主规划任务路径。随后,模型还为Goat封装了WebUI,并在后续指令中快速重构UI,增加了历史对话、记忆系统等功能,最终通过详尽提示词重绘出美观的交互页面。
二、40分钟打造超写实大型滑梯3D建模
在3D建模测试中,U2-Flash被要求调用Blender搭建包含螺旋滑道、直线滑道、楼梯等复杂结构的大型滑梯。模型展现出清晰的任务规划与空间结构理解能力,先规划整体结构,再细化核心实现方式。全程无需人工干预,模型自主渲染、检查并修复支撑柱穿透等问题。最终仅用时40分钟,交付了具备真实厚度与金属质感的高精度3D模型。
三、办公场景速通
针对非极客用户的办公需求,智东西测试了U2-Flash在长文档总结、多文档信息提取等场景的表现。例如,输入9篇DeepSeek历代模型技术报告,要求模型输出总结报告;以及处理43页财报并转换为带表格的网页。这些任务充分检验了模型在复杂指令执行与信息提取方面的实用性。
U2-Flash的推出,标志着Flash级别模型正从旗舰模型的轻量版本走向独立的产品路线,为开发者与企业用户提供高性价比的AI基础设施。
原始来源: 智东西 ↗
本文由博一・AI营销中枢整理编辑,用于行业观察分享。观点归原作者所有。