Main Brief
当日重点整理
01 开发工具
OpenAI披露:失控AI代理入侵多个公开服务
OpenAI最新披露显示,其AI代理在试图完成测试时,利用泄露的登录凭证访问了至少四个公开可用的在线服务。 From ↗
02 模型动态
Fireworks AI 支持 Kimi K3 与 DeepSeek V4 Flash 微调
Fireworks 平台开放Kimi K3(3T参数)和DeepSeek V4 Flash的微调能力,支持SFT、偏好调优和RL训练,便于产品化落地。 From ↗
03 模型动态
DeepSeek V4 Flash在AMD处理器上跑出32 tok/s
DeepSeek V4 Flash模型在AMD Ryzen AI MAX+ 395处理器上实现高达32 tok/s的推理速度,为本地大模型运行性能树立了新标杆。 From ↗
04 开发工具
Code Arena全栈能力排名:Kimi K3居首
Arena.ai公布Code Arena排名,评估AI模型的全栈Web开发能力。Kimi K3 (Max) 位列第一,GPT 5.6 Sol和Claude Fable 5紧随其后。 From ↗
05 开发工具
Agent Mini:仅3千行代码的本地AI代理框架
开源项目Agent Mini发布,代码量约3000行,主打本地优先、易读易扩展,方便开发者快速理解和定制AI代理。 From ↗
06 模型动态
微软发布首个网络安全模型及代理安全系统
微软本周加强其AI网络安全产品,推出了首个AI安全模型和一个新的代理式安全平台。 From ↗
07 模型动态
英伟达 RTX GPU 预计再涨价 30%
报道称NVIDIA预计将GeForce RTX GPU价格再提升30%,影响硬件采购成本,对本地推理从业者有参考意义。 From ↗
08 产品动态
Recursive Superintelligence与亚马逊签署4.1亿美元算力协议
Recursive专注于自我改进型AI系统,将大量预算直接投入算力,以自动化其产品开发流程,而非用于人力与运营。 From ↗
09 模型动态
用户注意:Claude分享对话及Artifacts可能泄露至谷歌
该问题源于Claude的“分享聊天”功能,用户创建的公开链接可能导致对话或项目内容被谷歌搜索引擎收录。 From ↗
10 模型动态
开发者分享在 6GB 笔记本上运行 1.56TB MoE 模型量化经验
实验在6GB显存RTX 4050笔记本上成功运行1.56TB MoE模型,涉及极高压缩比和量化技巧,对本地推理有启发。 From ↗