当日重点整理
Claude Code v2.1.212更新:/fork改为/subtask,新增搜索限制等
Claude Code发布v2.1.212:`/fork`改为启动后台会话,原子代理改为`/subtask`;新增自动模式重置命令;新增WebSearch会话级搜索限制(默认200次),防止搜索循环失控。 From ↗
Kimi K3写作能力超越Claude Fable5
据用户实测,Kimi K3在写作任务上表现超越Claude Fable5,成为社区热议焦点。此前K3已在多项基准上接近GPT-5.5和Opus 4.8。 From ↗
Kimi K3发布:2.8万亿参数开源模型,测评热议与价格调整
月之暗面发布Kimi K3,2.8万亿参数MoE,全球最大开源模型。全面测评显示与Opus 4.8不相上下,但不及Fable 5/5.6;官方价涨至输入$3/输出$15,约2-3倍。社区热议其开源意义。 From ↗
Inkling在Frontend Code Arena开放模型排名第10
Inkling在开放权重模型中排名#10(1434 pts),整体排名#37,是美国最好的开放模型,且在品牌营销、数据分析等领域表现突出。 From ↗
Kimi K3性价比突出:2.8T参数与GPT-5.6同分但更便宜
Kimi K3作为最大开源模型(2.8T参数),基准与GPT-5.6和Fable 5持平,但价格仅$3/M输入、$15/M输出,与Sonnet 5相同,被评测为开源模型的里程碑。 From ↗
Kimi K3发布:2.8T超大开源模型,逼近世界一线
Kimi K3是一个参数量达2.8T的开源模型,很多网友体感超过Opus4.8,强于5.5,仅次于Fable 5和5.6 Sol。这意味着中国开源模型距离世界一线差距缩小至6个月内。同时只有199档位的会员可以调用1M的长上下文,而API调用费用输入20元/M 输出100元/M,跟sonnet与5.6 Terra定价几乎一致。 From ↗
Kimi K3进入Agent Arena评测
Kimi K3现已登陆Agent Arena,该评测模拟真实长程agent任务,支持网页搜索、文件系统和终端工具。K3还可用于文本、视觉、文档和前端代码竞技场。 From ↗
Google Vids 新增 AI 化身,用户可“出演”视频
Google 为 Vids 引入个性化 AI 化身,用户能以数字分身参与视频创作,同时借助 Gemini Omni 功能,通过提示词和参考图生成并编辑视频。 From ↗
Kimi K3 Frontend Code Arena胜率76%,Text Arena跃居第9
Kimi K3在Frontend Code Arena以76% pairwise win rate登顶,超Claude Fable 5(63%)和GPT-5.6 Sol(58%)。Text Arena排名从#38升至#9,并宣布7月27日发布完整权重。 From ↗
Thinking Machines 发布首个开源模型 Inkling,挑战通用 AI
该公司历时一年半低调构建 AI 基础设施后,首次公开成果:推出开源模型 Inkling,押注非“一刀切”式 AI 路线。 From ↗