Main Brief
当日重点整理
01 开发工具
Qwen3.8-Flash-Next进入Agent Arena并位列开放模型第七
Qwen3.8-Flash-Next在8700多场真实Agent会话中排名开放模型第7,整体净提升2.4%,确认成功率提升12.3%。 From ↗
02 模型动态
单张RTX 6000 Pro跑Qwen3.8-Next-Flash达240 tokens/s
社区用户通过优化SGLang,在单张RTX 6000 Pro上实现最高240 tokens/s的推理速度,展示本地推理吞吐与GPU利用率优化空间。 From ↗
03 模型动态
五角大楼引入ChatGPT与Grok AI工具
OpenAI的ChatGPT和SpaceXAI的Grok将加入谷歌Gemini,进入五角大楼中央AI工具门户,供国防部门使用。 From ↗
04 开发工具
Runway发布首个Interface World Model Solaris
Solaris可实时逐帧生成无需代码的交互式界面,研究称其在新界面的结构与功能生成上超过前沿大模型。 From ↗
05 模型动态
社区完成Gemma4-12B稠密模型的专家模块改造
LocalLLaMA用户为Gemma4-12B增加专家模块,将稠密模型改造成类MoE结构,并观察到部分通用能力恢复,尚待系统验证。 From ↗
06 模型动态
AWS演示MCP服务器接入Amazon Quick方法
AWS展示如何将AgentCore Runtime托管的MCP服务器接入Amazon Quick,使模型能标准化访问文件、数据库和API。 From ↗
07 模型动态
滑动窗口注意力结合attention sinks降低长上下文成本
新论文提出用滑动窗口注意力结合attention sinks替代二次复杂度注意力,无需后训练即可降低长上下文推理内存需求。 From ↗
08 行业资讯
英伟达35亿美元投资联发科应对AI芯片竞争
英伟达向联发科投资35亿美元,旨在应对大型科技公司自研AI芯片的趋势,确保其在AI基础设施中的关键地位。 From ↗
09 开发工具
LlamaParse成为Claude官方认证连接器
LlamaParse可将复杂PDF、表格、扫描表单和图表转为Agent可用上下文,补强Claude处理企业文档的能力。 From ↗
10 开发工具
谷歌展示Gemini与Antigravity协作解决复杂工程任务
Gemini 3.7 Flash结合Antigravity多智能体协作,已用于开放数学问题、CPU模拟器和开源软件优化等复杂任务。 From ↗