Main Brief

当日重点整理

01 ai

LayerStoRm 尝试让消费级 GPU 运行超显存 MoE 模型

LayerStoRm 采用专家流式推理,将系统内存用于承载约 186 GiB 的 MoE 模型;项目作者称,在两张 RTX 5090 和两张 RTX 5080 上可达到约 24.5 tok/s。 From ↗

02 ai

Struggle Bench 尝试按真实经营成本评测模型

社区提出 Struggle Bench,让模型在资金、房租和电费等经营约束下完成任务,试图将评测重点从单纯能力分数扩展到实际经济可行性。 From ↗

03 ai

OpenAI 披露自动化研究实习生的阶段性进展

OpenAI 相关报告称,其已实现能够连续数天独立工作的自动化 AI 研究实习生,并计划在 2028 年前继续推进自动化研究能力;报告同时强调递归自我改进必须接受人类控制。 From ↗

04 ai

公开披露漏洞中的大部分已在当天遭到利用

Andreessen Horowitz 援引数据称,约 87% 的实际遭利用漏洞在公开披露当天或更早就已遭攻击,而 2020 年这一比例约为 23%,漏洞修复窗口正在缩短。 From ↗

05 ai

AI 数据中心建设带动超过 30 万个建筑岗位

高盛数据显示,自 2022 年以来,AI 基础设施建设已带动超过 30 万个建筑岗位,电工和暖通等相关岗位的增速约为行业平均水平的两倍。 From ↗

06 ai

中国收紧中小学生独立使用生成式 AI 的范围

相关要求提出,小学一至六年级学生不得独立使用 AIGC 功能,初中生可在适度范围内探索;教师可以使用 AI 辅助教学,但不能以 AI 代替答疑。 From ↗

07 ai

World Labs 发布 Atlas,探索统一三维重建与生成式视觉

World Labs 介绍 Atlas,尝试将三维重建与生成式视觉能力结合,相关方向可能影响世界模型、计算机视觉和视频生成技术的发展。 From ↗

08 ai

Browser Use 宣布原生支持 WebMCP

Browser Use 宣布原生支持 WebMCP,使 AI 代理可以通过标准接口确定性调用网页能力,减少对传统用户界面操作的依赖。 From ↗

09 ai

OpenAI 研究人员开始大规模使用编码代理

公开信息显示,OpenAI 内部研究人员正在使用编码代理辅助工作,7 月中旬 Token 消耗量明显上升,可能反映编码代理在内部工作流中的快速普及。 From ↗

10 ai

llama.cpp 新增 Spark-X2.5 模型支持

llama.cpp 加入对 Spark-X2.5-4B 和 1.7B 的支持,进一步扩大紧凑型模型在本地推理生态中的可部署范围。 From ↗