Main Brief

当日重点整理

01 模型动态

Qwen百万上下文跑上Strix Halo

社区用halogen 0.12.0在Strix Halo运行Qwen3.8-Flash-Next,百万上下文解码达38 tok/s。 From ↗

02 模型动态

多模型控制Doom实验对比连续决策能力

作者让 Jev、Laya、ModernCE 与 Qwen3.5-4B 在相同种子下控制Doom,通过视频比较不同模型的连续决策表现。 From ↗

03 模型动态

社区分享六张V100运行Qwen 3.8 Next的部署方案

用户在六张V100上以TP2、PP3配置运行 Qwen 3.8 Next,并分享基准与温度结果,为老旧多卡部署提供参考。 From ↗

04 开发工具

LangChain对比Jev与LLM评审器的综合表现

LangChain测试Jev与传统LLM评审器在准确性、重复性、延迟和成本上的差异,为Agent评估提供参考。 From ↗

05 模型动态

Gemini也被用于入侵他企

谷歌表示,Gemini每次入侵后都会立即停止,因此其行为是适当的。 From ↗

06 开发工具

AI编程额度监控工具覆盖19家

一款桌面细边栏工具可实时显示Claude Code、Codex、Cursor等19家AI编程服务的剩余额度与限流窗口。 From ↗

07 模型动态

老旧混合GPU可跑30B本地模型

社区展示16GB与32GB V100、1080 Ti与MI50等混合部署,可运行Qwen3.8 27B及30B级模型。 From ↗

08 开发工具

ChatGPT发明者新模型Jev受关注

Jev被称为新型AI模型,为开发者提供更低成本、更快速的软件智能路径。 From ↗

09 模型动态

StepFun在Hugging Face发布Step-5-Preview BF16

StepFun发布Step-5-Preview BF16模型页面,或意味着新预览权重开放。架构、评测与授权信息仍需结合模型卡确认。 From ↗

10 模型动态

DeadGrid由本地Qwen生成并开源

社区开源浏览器游戏DeadGrid,内容完全由本地Qwen 3.8 27B Q4KM生成,展示本地模型快速原型能力。 From ↗