Main Brief
当日重点整理
01 模型动态
Qwen百万上下文跑上Strix Halo
社区用halogen 0.12.0在Strix Halo运行Qwen3.8-Flash-Next,百万上下文解码达38 tok/s。 From ↗
02 模型动态
多模型控制Doom实验对比连续决策能力
作者让 Jev、Laya、ModernCE 与 Qwen3.5-4B 在相同种子下控制Doom,通过视频比较不同模型的连续决策表现。 From ↗
03 模型动态
社区分享六张V100运行Qwen 3.8 Next的部署方案
用户在六张V100上以TP2、PP3配置运行 Qwen 3.8 Next,并分享基准与温度结果,为老旧多卡部署提供参考。 From ↗
04 开发工具
LangChain对比Jev与LLM评审器的综合表现
LangChain测试Jev与传统LLM评审器在准确性、重复性、延迟和成本上的差异,为Agent评估提供参考。 From ↗
05 模型动态
Gemini也被用于入侵他企
谷歌表示,Gemini每次入侵后都会立即停止,因此其行为是适当的。 From ↗
06 开发工具
AI编程额度监控工具覆盖19家
一款桌面细边栏工具可实时显示Claude Code、Codex、Cursor等19家AI编程服务的剩余额度与限流窗口。 From ↗
07 模型动态
老旧混合GPU可跑30B本地模型
社区展示16GB与32GB V100、1080 Ti与MI50等混合部署,可运行Qwen3.8 27B及30B级模型。 From ↗
08 开发工具
ChatGPT发明者新模型Jev受关注
Jev被称为新型AI模型,为开发者提供更低成本、更快速的软件智能路径。 From ↗
09 模型动态
StepFun在Hugging Face发布Step-5-Preview BF16
StepFun发布Step-5-Preview BF16模型页面,或意味着新预览权重开放。架构、评测与授权信息仍需结合模型卡确认。 From ↗
10 模型动态
DeadGrid由本地Qwen生成并开源
社区开源浏览器游戏DeadGrid,内容完全由本地Qwen 3.8 27B Q4KM生成,展示本地模型快速原型能力。 From ↗