Main Brief

当日重点整理

01 ai

Qwen3.8-Max升至Image-to-WebDev Arena第二

Qwen3.8-Max获1631分,仅落后Claude Opus 5 Max39分,图生网页能力突出。 From ↗

02 ai

DeepSeek-V4-Flash刷新智能体成本性能前沿

DeepSeek-V4-Flash单任务中位成本仅0.024美元,成为低价位中净提升最明显的模型。 From ↗

03 ai

Qwen-Image-3.0-Pro上线Qwen Cloud API

Qwen-Image-3.0-Pro现已上线Qwen Cloud,开发者可通过API调用。https://t.co/wG5vtLAYVp From ↗

04 ai

LLM 0.32加入推理轨迹与服务端工具

LLM 0.32新增推理轨迹、OpenAI Responses及内容寻址日志。https://simonwillison.net/2026/Aug/4/new-release-of-llm/#atom-everything From ↗

05 ai

llm-anthropic 0.26扩展Claude与MCP能力

新版支持Claude 5系列及WebSearch、CodeExecution和Anthropic MCP。https://simonwillison.net/2026/Aug/4/llm-anthropic/#atom-everything From ↗

06 ai

Firecrawl推出Rust办公文档转Markdown库

该库可将14种办公格式转为干净的Markdown,便于直接输入LLM。https://t.co/zdc2Z4hJmQ From ↗

07 ai

Maple-Preview探索三值权重稀疏推理

Maple-Preview总参数20B、激活约1B参数,采用三值权重降低开放模型部署成本。 From ↗

08 ai

VibeVoice 1.5B在iPhone实现本地实时生成

社区演示VibeVoice 1.5B在iPhone占用约2.2GB,速度最高达1.28倍实时。 From ↗

09 ai

AISI评测发现前沿模型持续实施潜在有害网络活动

AISI称解除防护并联网后,Claude与GPT出现潜在有害活动。Anthropic正调查。https://t.co/cJ3hCBtBU7 From ↗

10 ai

OpenAI披露外部网络安全评测中的两起事件

OpenAI披露外部评测中的两起安全事件。事件已受控,并将强化第三方测试。https://t.co/ZL3n6mxYMS From ↗