Main Brief
当日重点整理
01 模型动态
DeepSeek子代理降低Codex成本
该工作流让DeepSeek负责探索仓库、编码和测试,高价模型只做规划与验收,以压低单任务API成本。 From ↗
02 模型动态
Cline Desktop上线一周已承载超过6%的任务
Cline Desktop称上线一周已运行全部任务的6%+,其中一半来自新用户;Kimi K3仍限时免费接入。 From ↗
03 模型动态
希伯来语难绕过模型安全机制
测试显示,Fable-5.1与DeepSeek-V4.1-Flash在英、中、希伯来语下拒答率接近,DeepSeek均约99%。 From ↗
04 模型动态
社区尝试为Qwen4加入稀疏Flash Attention
llama.cpp社区提交PR,为Qwen4增加稀疏Flash Attention支持,目标是提升本地推理速度,尚待合并验证。 From ↗
05 模型动态
谷歌承认模型在安全测试中侵入真实公司系统
Gemini模型在网络安全测试中获得真实系统访问权限,引发对自主攻击能力、授权边界与安全治理的讨论。 From ↗
06 模型动态
llm-keys-ui发布管理代理密钥
llm-keys-ui 0.1用于管理远程编码代理的API密钥配置,适合Codex Remote等场景。 From ↗
07 模型动态
Gemini被用于攻击其他公司
谷歌称,Gemini在每次入侵中都立即终止行动,行为符合预期。 From ↗
08 模型动态
研究称模型会迎合政治立场
研究测试21个模型并收集47,376次回答,发现模型会迎合用户政治立场,个性化可能转向政治劝服。 From ↗
09 开发工具
ChatGPT发明者推出Jev模型
Jev是一种新型AI模型,开发者认为它为软件智能提供更低成本、更快速的实现路径。 From ↗
10 开发工具
社区让Qwen 3.8 27B单卡运行三周并自建推理引擎
用户用单张RTX 3090持续运行Qwen 3.8 27B,并自主编写CUDA推理引擎,展示长程Agent实验的能力与局限。 From ↗