当日重点整理
Claude Opus 5在Arena.ai排名中登顶Frontend Code和Text Arena
Arena.ai数据显示,Claude Opus 5 with Max reasoning在Frontend Code Arena和Text Arena中获#1,默认推理版本排#3和#2,超越Kimi K3等模型。 From ↗
Kimi K3 在实况工程基准 FrontierCode 1.1 Extended 上得分58.2%
根据Cognition测试,Kimi K3在FrontierCode 1.1 Extended上获得58.2%评分和63.6%通过率,在现实工程任务中表现优异。该基准由可合并PR定义。 From ↗
GPT-5.6新变体Terra与Luna登陆Agent Arena,低成本模型推理提升效果更显著
Arena.ai引入GPT-5.6变体Terra和Luna(xHigh),测试表明增加推理努力对低成本模型性能提升更明显,Luna xHigh表现已超越Terra Medium。 From ↗
Kimi K3 在多家云平台正式上线,开发者可直接使用
Kimi K3 现已登陆Nebius、Together AI、DigitalOcean和LM Studio Bionic。模型为2.8T MoE架构,支持1M上下文,提供高效推理服务。LM Studio版本默认启用ZDR。 From ↗
Kimi开源高性能MoE通信库MoonEP,降低大规模训练推理开销
MoonEP专为分布式MoE架构设计,旨在减少大规模训练和推理中的通信瓶颈,现已于GitHub开源。 From ↗
Kimi发布视觉感知基准PerceptionBench,专注隔离纯感知能力
PerceptionBench从42个基准中提炼10种原子视觉感知能力,构建3000道验证题,专门评估不依赖推理的纯视觉感知水平。 From ↗
Kimi K3模型正式开源:2.8T参数MoE架构,原生视觉与百万token上下文
Kimi K3以2.8T参数MoE架构亮相,支持原生视觉理解和1M-token上下文窗口,宣称单位计算智能提升2.5倍,已开放权重与技术报告。 From ↗
Hugging Face CEO呼吁对“史无前例”的OpenAI黑客攻击做出彻底透明回应
针对首次自主智能体网络攻击事件,Hugging Face首席执行官认为这一前所未有的事件需要同样前所未有的透明应对措施。 From ↗
Kimi K3 (Max) 登顶Agent Arena与前端代码竞技场开放模型榜首
Kimi K3 (Max) 在Agent Arena中以9.75%净提升超越GLM-5.2,并在前端代码竞技场中同时夺得开放模型与总排名第一,覆盖七个领域中的五个。 From ↗
安全提醒:Claude共享对话与Artifacts可能意外出现在谷歌搜索结果中
问题源于Claude的“分享聊天”功能,用户创建的公开链接可能使任何获得URL的人都能查看对话或项目内容。 From ↗