本次观察覆盖2026年9月2日08:20至9月3日08:20(Australia/Sydney)前后正式发布并可核验的技术变化,收录2项。
Google发布Gemini 3.8 Flash与受限开放的Flash Cyber
Google于9月2日发布Gemini 3.8 Flash和Gemini 3.8 Flash Cyber。普通版已经在Gemini API、Google AI Studio、Android Studio、Antigravity、Stitch和Gemini Enterprise开放,也向Google AI Pro与Ultra订阅者提供。其推广期单价与3.7 Flash相同:每百万输入token 0.75美元、每百万输出token 3.75美元;Google同时说明,3.8在复杂任务中会使用更多推理步骤、工具调用和输出token,因此单个任务的总成本可能高于3.7。3.7 Flash仍受支持,可用于优先控制token消耗的工作负载。
Google报告3.8 Flash在HLE-Verified取得54.9%,并在软件工程与专业智能体评测中超过3.7 Flash。这些数据由开发者公布,尚不能视为完整的独立复现。The Verge独立确认了模型发布、开放渠道和定价,并引用Artificial Analysis的早期测量:在其任务集合中,3.8的每任务成本约高40%,主要来自输出token和智能体轮次增加;这是一项早期测量,不等同于所有工作负载的统一成本结论。
Flash Cyber使用相同的基础智能,但安全条件不同。它只通过新设的Fairwind Program向经过审核的政府机构、关键基础设施运营方和软件维护者开放。Google报告其内部20种编程语言漏洞发现测试成功率超过70%,CWE-Bench pass@1为47.2%,并公布Chrome补丁与Wiz内部评测结果;这些数字来自Google及合作方测试,目前没有完整公开复现。普通Flash带有CBRN和网络攻击防护,Cyber版采用更宽松的网络安全限制,因此没有面向一般用户开放。
Meta发布Muse Spark 1.3并开始API部署
Meta于9月2日发布Muse Spark 1.3,并在Muse Code与Meta Model API中开始上线。相对于1.2,1.3重点调整了长任务与编码智能体的运行方式:可以在同一长对话中处理多个工作流,遇到含糊要求时询问用户,受阻时请求协助,并在执行具有后果的操作前确认。此前已有的推理模式已开放;“max reasoning”仍需完成额外安全测试,尚未提供。
Meta工程师的内部比较显示,1.3相对1.2减少约20%的工具调用和约25%的token。这是开发者评测,尚无公开的跨平台独立复现。Meta还报告了对提示注入和对抗输入的抵抗改进,但没有在公告中提供足以独立复核的完整测试数据。Axios确认了9月2日发布、Muse Code和API上线,以及价格与前代相同。Muse Spark 1.3目前是专有服务;Meta只把开放权重列为后续计划,没有在本次发布中交付权重。
来源
Google,“Introducing Gemini 3.8 Flash and 3.8 Flash Cyber”,2026年9月2日:https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/
The Verge,“Google says its new Gemini 3.8 Flash model ‘works harder’ but might cost more”,2026年9月2日:https://www.theverge.com/ai-artificial-intelligence/988742/google-gemini-3-8-flash
Meta AI Research,“Introducing Muse Spark 1.3”,2026年9月2日:https://research.meta.ai/blog/introducing-muse-spark-1-3
Axios,“Meta debuts Muse Spark 1.3 as personal agent work continues”,2026年9月2日:https://www.axios.com/2026/09/02/meta-debuts-muse-spark-13-as-personal-agent-work-continues
了解 Geoffrey Chen 的更多信息
订阅后即可通过电子邮件收到最新文章。