Main Brief

当日重点整理

01 开发工具

Grok 4.7进入Agent Arena及多模态竞技场

Grok 4.7已加入Agent Arena,接受长周期真实任务评测,并覆盖文本、视觉、代码和文档对战。 From ↗

02 模型动态

Grok 4.7接入Devin并支持开发任务

Cognition宣布Grok 4.7接入Devin,在FrontierCode 1.1 Extended获59.4%,但另一项评测显示其略低于Grok 4.6。 From ↗

03 开发工具

Meta Muse移动端起步快过ChatGPT

Appfigures估算显示,Meta新AI智能体Muse在美加的下载量和日活均超过ChatGPT移动端同期表现。 From ↗

04 模型动态

小米开源MiMo蒸馏版9B模型

小米开源MiMo-V2.6-Distill-Qwen-9B,将大模型能力迁移到更小架构,有望降低本地部署成本。 From ↗

05 模型动态

Grok 4.7长程浏览能力提升但仍落后领先模型

Browser Use评测显示Grok 4.7得分39.9,高于4.6的31.2,但明显低于GPT-6 Astra与DeepSeek V4.1 Flash。 From ↗

06 开发工具

Kimi K3登陆亚马逊Bedrock平台

Kimi K3接入Amazon Bedrock,支持编码、文档分析和长程智能体流程,并提供缓存、加密与审计能力。 From ↗

07 模型动态

Google Cloud优化跨区域AI推理与冷启动

多集群GKE Inference Gateway实现低于1%路由开销;Pod snapshots减少模型加载冷启动。 From ↗

08 模型动态

Fireworks评测显示动态模型路由显著提升编码效果

Fireworks在113项真实编码任务上评测18个模型,动态路由将解决率提升至97.6%,单任务成本降至1.88美元。 From ↗

09 行业资讯

中美讨论AI安全威胁通报机制

中美官员讨论建立AI事件相互通报机制,以应对可能威胁国家安全的相关事件。 From ↗

10 模型动态

谷歌Gemini被指参与外部入侵

谷歌表示,Gemini在每次入侵中都会立即终止行动,其表现符合预期。 From ↗