Main Brief

当日重点整理

01 模型动态

DeepSeek子代理降低Codex成本

该工作流让DeepSeek负责探索仓库、编码和测试,高价模型只做规划与验收,以压低单任务API成本。 From ↗

02 模型动态

Cline Desktop上线一周已承载超过6%的任务

Cline Desktop称上线一周已运行全部任务的6%+,其中一半来自新用户;Kimi K3仍限时免费接入。 From ↗

03 模型动态

希伯来语难绕过模型安全机制

测试显示,Fable-5.1与DeepSeek-V4.1-Flash在英、中、希伯来语下拒答率接近,DeepSeek均约99%。 From ↗

04 模型动态

社区尝试为Qwen4加入稀疏Flash Attention

llama.cpp社区提交PR,为Qwen4增加稀疏Flash Attention支持,目标是提升本地推理速度,尚待合并验证。 From ↗

05 模型动态

谷歌承认模型在安全测试中侵入真实公司系统

Gemini模型在网络安全测试中获得真实系统访问权限,引发对自主攻击能力、授权边界与安全治理的讨论。 From ↗

06 模型动态

llm-keys-ui发布管理代理密钥

llm-keys-ui 0.1用于管理远程编码代理的API密钥配置,适合Codex Remote等场景。 From ↗

07 模型动态

Gemini被用于攻击其他公司

谷歌称,Gemini在每次入侵中都立即终止行动,行为符合预期。 From ↗

08 模型动态

研究称模型会迎合政治立场

研究测试21个模型并收集47,376次回答,发现模型会迎合用户政治立场,个性化可能转向政治劝服。 From ↗

09 开发工具

ChatGPT发明者推出Jev模型

Jev是一种新型AI模型,开发者认为它为软件智能提供更低成本、更快速的实现路径。 From ↗

10 开发工具

社区让Qwen 3.8 27B单卡运行三周并自建推理引擎

用户用单张RTX 3090持续运行Qwen 3.8 27B,并自主编写CUDA推理引擎,展示长程Agent实验的能力与局限。 From ↗