daily
Aug 18, 2026
AI 日报 — 2026-08-18
中文 English
OpenAI暂停RL保安全,Anthropic警示超级智能,GLM-5.3发布
涵盖 38 条 AI 新闻
🔥 今日焦点
1. OpenAI 暂停前沿强化学习训练以确保安全标准
OpenAI 已暂停部分前沿强化学习运行,以先验证对齐、安全和监控标准。此举表明,安全正日益决定 AI 进步的节奏,尽管该公司仍致力于广泛提供前沿能力。 来源-x
2. Anthropic 警告超级智能可能在 2026 年底到来
Anthropic 重申模型能力正在快速提升,开放权重系统正与专有模型展开竞争,并警告强大 AI 可能在 2026 年底或 2027 年初到来。时间线的加速促使一些前沿实验室限制访问,凸显了开放与安全之间日益增长的张力。 来源-x
3. GLM-5.3 API 发布,聚焦编程、网络安全与智能体任务
Z.ai 发布了 GLM-5.3 API,专为编程、防御性网络安全和长周期智能体任务打造,定价与 GLM-5.2 相同。该版本可通过官方 API 和合作伙伴模型网关获取,为智能体和安全密集型 AI 工作负载增添了更多竞争性选择。 来源-x
📰 重点报道
AI 安全与监管
- Anthropic 为 AI 文本添加水印,年化收入达 650 亿美元,AI 走向智能体化 — Anthropic 开始为 AI 生成的文本添加水印以符合欧盟法规,同时年化收入达到 650 亿美元。与此同时,随着 Nvidia 开源物理 AI 工具包、Gartner 预测到 2026 年智能体将出现在 40% 的企业应用中,整个行业正加速转向智能体 AI。 来源-reddit
行业与产品
- Claude 新增 Gmail 和 Google Drive 集成 — Claude 现在可以在用户可控批准下起草和发送电子邮件、管理 Drive 文件,并已向所有付费套餐推出。 来源-x
- Harvey II:更智能的法律工作 AI 智能体 — Harvey 发布了 Harvey II,搭载其首个专为法律工作训练的模型 Harvey Tenet,围绕案件和项目组织智能体,支持任务分配与审查。 来源-x
开源与基础设施
- Mojo AI 语言正式开源 — Modular 将面向 AI 工作负载的高性能编程语言 Mojo 开源,开发者可自由使用并贡献工具链。 来源-x
- StateM 通过 Harness 扩展在 Terminal-Bench 2.1 上达到 95.3% 准确率 — 该智能体原生运行时利用持久状态、阶段局部上下文和可恢复运行手册,在不修改模型权重的情况下,在 Terminal-Bench 2.1 上实现 95.3% 的原始准确率。 来源-huggingface
基准与评测
- HarnessEval-W:面向基于推理的世界模型评估的新基准 — 一个新基准要求用推理链来支撑世界模型得分,并能在视觉推演中自动检测物理、因果和世界状态违规。 来源-huggingface
- VibeWorlding 框架训练多模态智能体构建 3D 世界 — VibeWorlding 提供了一个统一框架,用于对构建交互式 3D 世界的多模态智能体进行基准测试和训练,测试用户意图推断、工具使用以及对文本和视觉 3D 信息的推理能力。 来源-huggingface
⚡ 快讯速览
- 新论文提出面向开放式探索的大型发现模型 — 一篇新论文提出 Large Discovery Models,用于 LLM 驱动的开放式搜索与发现。 来源-huggingface
- 新强化学习方法改进 LLM 的多奖励策略优化 — 一种新的强化学习方法提升了 LLM 训练中的多奖励策略优化。 来源-huggingface
- MoneyPrinterTurbo:根据关键词生成短视频的 AI 工具 — MoneyPrinterTurbo 是一款开源 AI 工具,可根据关键词提示自动生成短视频。 来源-github
- Strix:发现应用漏洞的开源 AI 渗透测试工具 — Strix 是一款开源 AI 渗透测试工具,可发现应用漏洞。 来源-github
- ai-memory 工具为 AI 编程智能体提供长期记忆 — ai-memory 工具为 AI 编程智能体提供跨会话的持久长期记忆。 来源-github
- 开源库为 AI 智能体提供 817 项网络安全技能 — 一个新的开源库为 AI 智能体配备 817 项网络安全技能。 来源-github
- llmfit:帮助将 LLM 匹配到硬件的开源工具 — llmfit 帮助从业者根据本地硬件约束找到最适合的 LLM。 来源-github
- 研究发现:大量使用 LLM 与批判性思维减弱有关 — 多项研究将频繁使用 LLM 与批判性思维能力下降联系起来。 来源-reddit
- AI 定价市场乱象:从每百万 token 0.03 美元到 600 美元 — 一览混乱的 AI 定价格局,从每百万 token 0.03 美元到 600 美元不等。 来源-reddit
- Qwen vs GPT-5.6 vs Grok:Three.js 网站构建对决 — 用户对比了本地 Qwen 3.8 27B、GPT-5.6 Terra 和 Grok 4.6 构建 Three.js 网站的表现。 来源-reddit
- OpenAI 推出带安全功能的 ChatGPT 青少年版 — OpenAI 发布了 ChatGPT 青少年版,为年轻用户新增了安全功能。 来源-reddit
- Anthropic 将 Claude Code 周限额提升延长至 8 月 31 日 — Anthropic 将 Claude Code 每周使用限额的提升延长至 8 月 31 日。 来源-x
- Theo 为 T3 Code 辩护,驳斥不实批评报道 — Theo 对一篇他称之为不实的 T3 Code 批评报道进行了回击。 来源-x
- Deft AI Lab 推出 Beta 版,号称写出更好文本并绕过检测器 — Deft AI Lab 发布了 Beta 版,承诺提供能绕过 AI 检测器的更优质写作体验。 来源-x
- GPT-5.6 Sol 在 Devin Desktop 和 CLI 中享受 70% 折扣 — Devin 在桌面应用和 CLI 中提供 GPT-5.6 Sol 的 70% 折扣。 来源-x
- Nous Research 在 Hermes Desktop 中推出 Bot Mode,支持自定义机器人 — Nous Research 在 Hermes Desktop 中推出了 Bot Mode,支持自定义机器人。 来源-x
- 开源 AI 求职工具为职位列表打分并自动定制简历 — 一款新的开源工具可自动为职位列表评分并定制简历。 来源-github
- oMLX:在 Mac 上支持 SSD 缓存和连续批处理的 LLM 服务器 — oMLX 是一款面向 Mac 的 LLM 服务器,具备 SSD 缓存和连续批处理功能。 来源-github
- 中国 AI 模型质量接近付费工具,用户纷纷切换 — 中国 AI 模型的质量正接近付费级别,促使许多用户更换服务商。 来源-reddit
- pagedMark 从生成的图像和视频中剥离 AI 溯源信息 — pagedMark 是一款能够从 AI 生成的图像和视频中移除 AI 溯源元数据的工具。 来源-reddit
- Harris Poll 研究:人们为何喜爱和讨厌 AI — Harris Poll 的一项研究解析了人们喜爱与讨厌 AI 的原因。 来源-reddit
- AQuA 论文的缺陷特征在干净重切分中失效 — 对 AQuA 论文进行干净重切分后发现,其异常强结果依赖于一个缺陷特征。 来源-reddit
- Sainsbury’s 因误判入店行窃暂停 AI 人脸识别 — Sainsbury’s 在一次错误的入店行窃指控后暂停了其 AI 人脸识别系统。 来源-reddit
- AI 编程质量下降源于用户提示词粗糙,而非模型漂移 — 一项调查发现,AI 编程质量下降是由用户提示词不严谨导致,而非模型漂移。 来源-reddit
- 强制披露 AI 聊天机器人的呼声日益高涨 — 批评人士呼吁要求企业披露用户何时在与 AI 聊天机器人交互。 来源-reddit
- 谷歌在拍卖会上购入破产的 Spirit Airlines 数据用于 AI — 谷歌在破产拍卖中购入了 Spirit Airlines 的数据,用于 AI 目的。 来源-reddit
- AI 自动化究竟是节省时间还是制造更多工作? — 一场讨论探讨 AI 自动化究竟能否真正节省时间,抑或最终制造更多工作。 来源-reddit
- Claude 用户报告大范围宕机 — 用户报告又一次影响 Claude 的大范围宕机。 来源-reddit
由 AI 新闻代理生成 | 2026-08-18