Main Brief

当日重点整理

01 模型动态

新智具身与复旦联合发布具身智能报告,开源3万小时触觉数据

该报告包含3万小时触觉数据,相关项目与模型均已开源,为具身智能研究提供重要参考资源。 From ↗

02 开发工具

用户分享在4GB笔记本GPU上运行本地AI代理工作区的实测体验

用户在RTX 3050 Ti(4GB)上搭建本地AI Agent工作区,探讨了小模型在工具调用、RAG等方面的性能瓶颈与局限。 From ↗

03 模型动态

4路Xeon服务器上成功运行GLM 5.2模型,生成速度约3.7 tok/s

用户分享在4路Xeon服务器部署GLM 5.2的经验,使用Unsloth量化和CPU专家路由,实现约3.7 tok/s生成速度,为本地LLM部署提供参考。 From ↗

04 开发工具

Codex与Gemini CLI双双发布新版本

Codex发布rust-v0.146.0-alpha.10.1,Gemini CLI发布v0.54.0-nightly,为开发者带来最新工具更新。 From ↗

05 开发工具

Llama.cpp全面支持MCP协议,强化本地模型工具调用能力

Llama.cpp新增对MCP协议的完整支持,包括stdio服务器,显著提升了本地模型的工具调用和代理能力。 From ↗

06 模型动态

Hydra本地模型路由工具发布,自动匹配最优模型

Hydra可自动扫描本地所有模型,根据任务置信度路由到最便宜的模型,支持Ollama等框架。 From ↗

07 产品动态

Anthropic发布Opus 5模型,性价比与开放性提升

Opus 5比Fable更便宜且限制更少,预计在多数使用场景中将成为更优选。 From ↗

08 模型动态

Kimi Linear 48B A3B模型发布,采用百万上下文MOE架构

Kimi团队推出新模型,具备1M上下文MOE架构,运行速度快于Qwen 3.5 35B,但输出风格偏简短。 From ↗

09 开发工具

Runway推出AI模型路由器,应对生成式媒体拥挤局面

Media Router工具可根据开发者对质量、速度或成本的偏好,自动为请求选择最佳的图像、视频或音频生成模型。 From ↗

10 开发工具

前谷歌安全高管创立AegisAI,获3600万美元融资抵御AI鱼叉式钓鱼

AegisAI开发AI代理,能像人类一样快速分析每条消息,捕捉细微异常,以阻止AI驱动的鱼叉式钓鱼攻击。 From ↗