daily
Aug 10, 2026

AI 日报 — 2026-08-10

中文 English

>让 claude 去解黎曼猜想... · 我们正在发布新模型(GPT-5.6-Cyb... · 今天我们推出 Dyna-2,一个世界...


涵盖 31 条 AI 新闻

⚡ 快讯速览

  • >让 claude 去解黎曼猜想 >失败 650 次 >claude:“兄弟我不行了” >“兄弟你只管相信… — >让 claude 去解黎曼猜想 >失败 650 次 >claude:“兄弟我不行了” >“兄弟你只管相信自己” >claude:“好” >进入状态 >召唤 60 个自己的分身 >3100 万 token 之后 >惊喜 来源-twitter
  • 我们正在发布新模型(GPT-5.6-Cyber),并扩展 Daybreak 以帮助将前沿智能… — 我们正在发布新模型(GPT-5.6-Cyber),并扩展 Daybreak 以帮助将前沿智能交到防御者手中:OpenAI 6小时前 我们正在扩展网络安全计划 Daybreak,并引入… 来源-twitter
  • 今天我们推出 Dyna-2,一个基于一百万小时人类视频预训练的世界动作模型… — 今天我们推出 Dyna-2,一个基于一百万小时人类视频预训练的世界动作模型。在这一规模下,我们首次发现了若干新的缩放定律:• 世界动作模型… 来源-twitter
  • 简直不可思议。这可能是迄今最清晰地展现 AI 将如何改变科学发现的一瞥… — 简直不可思议。这可能是迄今最清晰地展现 AI 将如何改变科学发现的一瞥。Anthropic 让一个未发布版本的 Claude 真正尝试攻克黎曼猜想,… 来源-twitter
  • 感谢 Mark、Alex 以及整个 Meta 团队对开放权重 AI 的贡献。Mark Zuckerb… — 感谢 Mark、Alex 以及整个 Meta 团队对开放权重 AI 的贡献。Mark Zuckerberg 13小时前 今天我们还将开放 Muse Glimmer 的权重,这是一个出色的 300 亿参数稠密模型,… 来源-twitter
  • 个人超级智能应该对每个人可用,而开放我们模型的访问权限正是其中重要… — 个人超级智能应该对每个人可用,而开放我们模型的访问权限正是其中重要一环。更多内容请阅读 mark 的文章:meta.com/futureisforeveryone Mark Zuckerberg 13小时前 我相信每个… 来源-twitter
  • 今天我们发布 GPT-5.6-Cyber。该模型是我们首次大规模尝试直接提升… — 今天我们发布 GPT-5.6-Cyber。该模型是我们首次大规模尝试直接提升高级网络安全任务(如漏洞利用开发)的能力。我们发现它… 来源-twitter
  • Muse Glimmer 现在可以通过 Ollama 运行。即日起可通过 Ollama 的 MLX 引擎使用,在 Apple Silicon 上拥有最先进的性能… — Muse Glimmer 现在可以通过 Ollama 运行。即日起可通过 Ollama 的 MLX 引擎使用,在 Apple Silicon 上拥有最先进的性能。Muse Glimmer 可以为 Claude Code、Codex 等提供支持,始终… 来源-twitter
  • Gemini 自 2024 年以来也一直在这样做。Google 使用一个密钥让模型偏向某些 token,从而产生可检测的统计特征——一种嵌入在所有文本生成中的隐形模式… — Gemini 自 2024 年以来也一直在这样做。Google 使用一个密钥让模型偏向某些 token,从而产生可检测的统计特征——一种嵌入在所有文本生成中的隐形模式… 来源-twitter
  • DiffusionGemma 完整技术报告正式上线!我们正在分享完整的过程和… — DiffusionGemma 完整技术报告正式上线!我们正在分享完整的过程和见解,以帮助社区探索文本扩散模型的惊人潜力。我们很高兴… 来源-twitter
  • 适用于 Metal 的快速 H3 实现。尽情使用、修改:github.com/antirez/h3.c 包含来自… — 适用于 Metal 的快速 H3 实现。尽情使用、修改:github.com/antirez/h3.c 包含来自 @liuliu 的代码,欢迎他取回任何喜欢的部分用于 @drawthingsapp,以防… 来源-twitter
  • ……以及激烈的竞争。顺便说一句,我猜这意味着 haiku 的终结。但欢迎纠正我 @An… — ……以及激烈的竞争。顺便说一句,我猜这意味着 haiku 的终结。但欢迎纠正我 @AnthropicAI Claude 4小时前 我们将 Claude Sonnet 5 的优惠定价永久化。我们推出了 Sonnet… 来源-twitter
  • 重磅:Meta 表示将“很快”恢复发布开源 AI 模型,作为更大计划的一部分:… — 重磅:Meta 表示将“很快”恢复发布开源 AI 模型,作为更大计划的一部分:为数十亿人提供个人超级智能!Zuckerberg 承诺提供免费或负担得… 来源-twitter
  • LLM 审稿怪象……仅仅把上传的 PDF 从 “paper.pdf” 重命名为 “paper_final_draft_pdf… — LLM 审稿怪象……仅仅把上传的 PDF 从 “paper.pdf” 重命名为 “paper_final_draft_pdf_ready_for_review.pdf” 就能提升平均分数(gpt-5.6-terra) 来源-twitter
  • 询问。预订。享用。再来一次。ChatGPT 现在可以通过 @OpenTable、Resy 和 @… 帮你找到并预订餐桌 — 询问。预订。享用。再来一次。ChatGPT 现在可以通过 @OpenTable、Resy 和 @Yelp 帮你找到并预订餐桌 🍽️ 来源-twitter
  • 感知言语的可解释 MEG 解码:皮层来源与驱动检索的刺激特征 — 通过使用 CLIP 风格目标针对 wav2vec 2.0 音频嵌入训练的深度网络,可以从非侵入性脑磁图(MEG)记录中检索出感知到的言语短片段… 来源-huggingface
  • 从经济智能体到智能体经济体:经济世界模型的系统蓝图 — 经济世界模型(EWM)是一种生成式经济模型,通过对异构智能体、其信念与行动以及市场与制度…进行建模,从内部模拟经济如何演化 来源-huggingface
  • SFT 冲突,RL 共存:LLM 多任务学习的理论与实证分析 — 监督微调(SFT)和强化学习(RL)在提升大型语言模型(LLM)的多任务推理方面表现出截然不同的行为。我们的初步实验… 来源-huggingface
  • DataSpace:面向异构工作空间可验证分析的数据智能体基准 — 数据智能体支持对组织工作空间进行自然语言分析,而相关证据可能分散在数据库、结构化文件、长文档和多媒体中。现有基准… 来源-huggingface
  • 教 Nemotron 学希腊语:为专业领域的现代希腊语挖掘语料、适配检索、锚定生成 — 现代希腊语在 NVIDIA 的 Nemotron 检索模型和主要的多语言检索基准中都是缺失的,尽管它在法律、能源、金融等专业领域的检索增强生成(RAG)中非常重要… 来源-huggingface
  • 最佳本地 LLM — 2026 年 8 月 — 哇!!就在你以为开放权重模型已经好到不能再好时,我们可能又迎来了最好的时期!?!?!能媲美闭源前沿的模型,在不算离谱的硬件上跑出 Opus 级别模型的… 来源-reddit
  • 我花了约 200 美元,用 200 亿 token 从零训练了一个 10 亿参数的 LLM — 几个月前,我有了一个想法:把从零构建 LLM 作为个人项目(为了学习,也部分为了美化我的简历)。由于过去一年我从这里的其他帖子中学到了很多… 来源-reddit
  • inclusionAI/Ling-3.0-tiny · 8B A1.3B MoE· Hugging Face — 看起来 Ling 团队开放了几天前发布的 Ling-3.0-flash 的一个小得多的版本的权重。它有 80 亿参数、13 亿激活参数,似乎介于 Qwen 4B 和 8-12B 之间… 来源-reddit
  • DiffusionGemma 技术报告 — arXiv:https://arxiv.org/abs/2608.00146 完整论文:https://arxiv.org/pdf/2608.00146 推文:https://xcancel.com/googlegemma/status/2086849199052845451#m 顺便说一下,(llama.cpp)的两个 PR(24423 和 24427)… 来源-reddit
  • Needle 2:适用于手机、可穿戴设备、智能家居和机器人的 14MB 智能体 LLM — 大家好 LocalLlaMa,我是 Cactus 的 Henry!我们之前发布了 Cactus Needle,一个 14MB 的智能体 LLM,适用于手机、可穿戴设备、智能家居、小型机器人等的工具调用、设备使用和结构化提取… 来源-reddit
  • 从 llama.cpp 的 -np(并行)1 切换到 vllm 上的并行请求? — 我读到过,在超出 llama 的 “-np 1” 之后,最好切换到 vllm,因为 vllm 对并行请求有更好的支持。说一下背景:我有一块 RTX 5080,但我正在尝试一些功能… 来源-reddit
  • 我已将 Maple-Preview 添加到 Mference,在 Air M4 上仅用 500MB 内存就实现了每秒 40 token 的生成速度 — 我喜欢在本地运行模型的想法,但不喜欢让它们吃光我所有内存的想法。我一直认为,构建端侧模型的最佳方式是做出足够智能… 来源-reddit
  • 那么……我们放弃禁止 AI 帖子的规则了吗? — 这个 Sub 被水帖淹没了。新规则刚出来后情况好了一些。但过去一个月左右又变得无法忍受了。由 /u/kevin_1994 提交 [链接] [评论] 来源-reddit
  • KPMG:近半数高管因成本问题撤回了 AI 智能体https://www.forbes.com/sites/sandycarter/2026/08/09/kpmg-says-nearly-half-of-executives-pulled-back-ai-agents-over-cost/ 泡沫开始破裂了?由 /u/MoodDelicious3920 提交 [链接] [评论] 来源-reddit
  • KLQ:免训练的度量旋转量化。在 W4A4KV4 位宽上击败所有免训练的旋转量化方法。KLQ 量化的 Llama 3.2 1B 击败 SpinQuant,并在没有 GPTQ/LDLQ 舍入的情况下接近 ReSpinQuant。 — 首先,我不是研究实验室,这是一个暑期个人研究项目,最终沉淀成了 github 仓库和这篇报告。仓库包含更深入的方法探讨、关于量化…的发现 来源-reddit
  • 字节跳动承诺避免 AI 蒸馏,以自己的方式开发新模型 — 由 /u/etherd0t 提交 [链接] [评论] 来源-reddit

由 AI 新闻智能体生成 | 2026-08-10