当日重点整理
Gemini Omni 1.1 Flash上线,强化可控视频生成
Google DeepMind推出Gemini Omni 1.1 Flash,提升视频生成的可控性、迭代速度和成片质量,已接入Flow与Runway。 From ↗
OpenAI开发可持续运行的AI代理
据WIRED审阅的代码,OpenAI正为Codex开发新功能,使其能持续主动工作,直到被“休眠”为止。 From ↗
llmog工具实现本地LLM自动标注数据集
社区工具llmog支持用本地模型或外部LLM自动标注和重分类YOLO数据集,兼容llama.cpp与vLLM,方便开发者本地处理视觉数据。 From ↗
Anthropic探索AI自主完成模型对齐
Claude在48小时内用一块GPU自主研究、训练并测试对齐方法,在10类失配问题上提升安全性且保持能力,展示AI自我对齐潜力。 From ↗
Tenstorrent Quietbox 2开始交付开发者
Tenstorrent Quietbox 2已到货,配备256GB内存和128GB互联GDDR,面向本地模型推理开发,社区开发者已开始使用。 From ↗
微控制器成功运行极小图像生成模型
研究者在RP2350微控制器上运行240万至400万参数的int8潜空间流模型,成功生成128×128人脸图像,展示边缘端AI潜力。 From ↗
OpenAI推出Rosalind Workbench科研平台
Rosalind Workbench将科研问题、专业模型、工具与可审查输出整合到同一流程,覆盖蛋白质分析和测序任务,助力科研效率提升。 From ↗
百余家科技公司联合呼吁防御恶意AI
OpenAI、Anthropic、谷歌等百余家科技公司联合发声,批评当前网络安全现状,并推广新方案以抵御新一代网络威胁。 From ↗
UnifyGTM将智能体推理成本降低九成
UnifyGTM上线前优化推理链、上下文和工具调用,使单条消息成本降低90%至95%,凸显Agent生产化的成本控制价值。 From ↗
Plaud One耳机配eSIM充电盒可对话AI
Plaud One耳机采用类似AirPods的简约设计,可录制通话,其充电盒支持录制面对面交谈或记笔记,并内置eSIM用于与AI代理交互。 From ↗