Main Brief

当日重点整理

01 开发工具

小米发布MiMo-V2.5-DFlash,块扩散推测解码提速6倍

草稿模型采用block-diffusion架构,一次前向生成整块token,接受长度超6,编程场景速度提升6倍,权重仅2.94GB。 From ↗

02 模型动态

Fable成功解决数学物理学家Yuji Tachikawa长期未解问题

AI工具Fable成功解决数学物理学家Yuji Tachikawa及其合作者多年来未能解决的难题,展示AI在数学推理领域的突破性能力。 From ↗

03 开发工具

Opencode Agents vs Claude Code 对比:支持本地模型调用的替代方案

Reddit用户讨论Opencode Agents与Claude Code的对比,指出Opencode可调用本地模型,且在特定场景下可作为Claude Code的替代。 From ↗

04 模型动态

Mac Studio 96GB上运行Qwen3.5-122B,修复三个长上下文推理bug

用户分享修复三个bug后显著提升长上下文推理可用性的经验,大幅改善本地大模型运行效率。 From ↗

05 开发工具

分析称Fable 5延期是因GPU占用过高,GPT-5.6 Sol竞争缓解资源压力

Orange AI 分析Fable 5限时体验逻辑:GPU成本过高无ROI;GPT-5.6 Sol抢走用户后释放GPU资源,因此才继续放在Coding Plan中。 From ↗

06 模型动态

Moondream 3.1发布:9B参数2B活跃MoE视觉语言模型

Moondream 3.1采用9B参数2B活跃的MoE架构,在视觉推理和检测上达到SOTA,支持查询、检测等原生任务,部署高效。 From ↗

07 开发工具

Claude Code无法粘贴共享对话链接,用户吐槽体验痛点

Simon Willison 指出Claude Code不能粘贴共享对话链接,开发者需手动复制内容,影响工作流效率,属实用提醒。 From ↗

08 产品动态

Meta因用户反对移除Instagram争议AI功能

Meta表示该功能本意是提供创意工具并让用户控制内容引用,但收到反馈后决定下架,不再可用。 From ↗

09 模型动态

在64GB M2 Max上通过MLX运行Nemotron Puzzle 75B的实践分享

社区成功在64GB M2 Max上通过MLX运行Nemotron Puzzle 75B,对比了4位与5位专家量化性能差异,为苹果芯片大模型部署提供实用参考。 From ↗

10 开发工具

AI剪辑工具ChatCut推出极简安装教程

通过Codex安装MCP和Skill,OAuth授权后即可用自然语言指令生成图文配音视频,效果比文字描述更生动。 From ↗