9月3日,Meta发布新一代最强旗舰模型Muse Spark 1.3。在Artificial Analysis的AI分析指数榜上,新模型分数仅次于Claude Fable 5.1和Claude Opus 5,反超了同期发布的谷歌Gemini 3.8 Flash。
Meta超级智能实验室负责人、首席AI官汪滔表示,该模型成本极低,智能体、编程能力及易用性大幅提升。搭配Muse Code,其评测表现可媲美Claude Code + Opus 5/Fable 5。
在AI分析指数榜上,Muse Spark 1.3得分为62分,Gemini 3.8 Flash为59分。汪滔甚至在社交平台上对谷歌“贴脸开大”,直言“gemini who”。
基准测试显示,Muse Spark 1.3拿下5项第一,在文本、编程方面优于GPT-5.6 Sol和Claude Opus 5,仅在终端操作Agent测试中与GPT-5.6 Sol打平。其相对薄弱的是Agent能力,在联网搜索和通用知识任务中分数较低。
价格方面,Muse Spark 1.3的API定价与前代保持一致,每百万token输入(缓存未命中)1.25美元,输出4.25美元。该价格略高于Gemini 3.8 Flash,但比DeepSeek-V4-Pro的高峰期价格更便宜。
开发者实测反馈显示,Muse Spark 1.3速度快、成本低。例如制作《我的世界》游戏成本仅10美分;在3D模拟和复杂提示词自我迭代优化中,成本均控制在1美元以内。但在生成效果上,与Qwen 3.8 Max、GLM 5.3等顶尖模型相比仍有差距,距离前沿模型存在一定不足。
Meta博客指出,Muse Spark 1.3的核心优势在于支撑长周期任务及编程。它能在单条长对话中并行处理多条工作流,自主构建上下文并修正方案漏洞,在多步骤任务中更好保留细节要求,不偏离既定工作流。目前该模型已在Muse Code与Meta Model API中逐步推送上线。
原始来源: 智东西 ↗
本文由博一・AI营销中枢整理编辑,用于行业观察分享。观点归原作者所有。