Main Brief
当日重点整理
01 开发工具
Grok 4.7进入Agent Arena及多模态竞技场
Grok 4.7已加入Agent Arena,接受长周期真实任务评测,并覆盖文本、视觉、代码和文档对战。 From ↗
02 模型动态
Grok 4.7接入Devin并支持开发任务
Cognition宣布Grok 4.7接入Devin,在FrontierCode 1.1 Extended获59.4%,但另一项评测显示其略低于Grok 4.6。 From ↗
03 开发工具
Meta Muse移动端起步快过ChatGPT
Appfigures估算显示,Meta新AI智能体Muse在美加的下载量和日活均超过ChatGPT移动端同期表现。 From ↗
04 模型动态
小米开源MiMo蒸馏版9B模型
小米开源MiMo-V2.6-Distill-Qwen-9B,将大模型能力迁移到更小架构,有望降低本地部署成本。 From ↗
05 模型动态
Grok 4.7长程浏览能力提升但仍落后领先模型
Browser Use评测显示Grok 4.7得分39.9,高于4.6的31.2,但明显低于GPT-6 Astra与DeepSeek V4.1 Flash。 From ↗
06 开发工具
Kimi K3登陆亚马逊Bedrock平台
Kimi K3接入Amazon Bedrock,支持编码、文档分析和长程智能体流程,并提供缓存、加密与审计能力。 From ↗
07 模型动态
Google Cloud优化跨区域AI推理与冷启动
多集群GKE Inference Gateway实现低于1%路由开销;Pod snapshots减少模型加载冷启动。 From ↗
08 模型动态
Fireworks评测显示动态模型路由显著提升编码效果
Fireworks在113项真实编码任务上评测18个模型,动态路由将解决率提升至97.6%,单任务成本降至1.88美元。 From ↗
09 行业资讯
中美讨论AI安全威胁通报机制
中美官员讨论建立AI事件相互通报机制,以应对可能威胁国家安全的相关事件。 From ↗
10 模型动态
谷歌Gemini被指参与外部入侵
谷歌表示,Gemini在每次入侵中都会立即终止行动,其表现符合预期。 From ↗