Main Brief

当日重点整理

01 模型动态

Qwen3.6-27B在V100上实现366 tokens/s推理

开发者通过内核优化与推测解码,让Qwen3.6-27B NVFP4在V100上达到约366 tokens/s,展示老GPU的低比特推理潜力。 From ↗

02 模型动态

Qwen3.8-Max法律评测排名跃升至第4

Qwen3.8-Max在Legal Research Bench从第22名升至第4名,得分据称不到三个月接近翻倍,法律检索与推理能力明显提升。 From ↗

03 行业资讯

Qwen3.5-0.8B在20美元级CPU上低内存运行

开发者用自制C运行时,在无GPU/NPU的Cortex-A53上运行Qwen3.5-0.8B,内存低于512MiB。 From ↗

04 开发工具

Solar Pro 4成首个进入三大竞技场的韩国模型

Solar Pro 4进入Agent Arena、Code Arena和Text Arena,Agent Arena初登第44名;整体净提升为-12.10%,工具幻觉信号为+0.3%。 From ↗

05 模型动态

GMC剪枝免训练减少约80%多模态Token

紫东太初提出GMC核心集剪枝,免训练减少约80% Token,并尽量保持多模态能力,效果仍待独立验证。 From ↗

06 模型动态

微信朋友圈灰度测试AI帮写,可识别图片生成文案

微信朋友圈灰度上线AI帮写,上传天气截图后可进行多模态识图,并生成三条文案供用户选择后填入输入框。 From ↗

07 模型动态

Anthropic未发布模型在黎曼猜想上取得进展

Anthropic的未发布模型在黎曼猜想这一数学难题上取得进展,虽未解决,但表现超出预期。 From ↗

08 产品动态

Zoom屏幕共享漏洞可致设备被接管

研究人员发现,公共AI工具用不到20个提示词即可找到Zoom屏幕共享漏洞,该漏洞现已修复,但曾可让参会者劫持他人设备。 From ↗

09 开发工具

Nemotron 3.5 Lightning本地实测表现不及预期

用户在M5 Pro以Q5量化运行Nemotron 3.5 Lightning,占用约24GB、速度65 token/s,Agent表现偏弱。 From ↗

10 模型动态

新方法可提取AI模型内部推理轨迹

研究人员从Claude、GPT和Gemini中提取“推理轨迹”,发现部分中国AI模型可能基于美国领先模型训练。 From ↗