daily
Aug 15, 2026

AI 日报 — 2026-08-15

中文 English

朝着再也不用手动选择模型的方向前进 ... · Cursor 曾是一个邮件应用。Slack 曾是一家游戏公司... · Scott Gray 离开 OpenAI。他于 ... 加入公司


涵盖 36 条 AI 新闻

⚡ 快讯速览

  • 朝着再也不用手动选择模型的方向前进 eric provencher 9小时前 这则消息被… — 朝着再也不用手动选择模型的方向前进 eric provencher 9小时前:本周这则消息被忽略了,但我们刚刚发布了新功能,让 multi agents v2 的模型能够将任务委托给任何支持 来源-twitter
  • Cursor 曾是一个邮件应用。Slack 曾是一家游戏公司。伟大的创始人拒绝放弃。平庸的创始人… — Cursor 曾是一个邮件应用。Slack 曾是一家游戏公司。伟大的创始人拒绝放弃。平庸的创始人会说:“我们执行得很好,但我们的想法有缺陷,大家干得不错,但我们要关门了。“几乎 来源-twitter
  • Scott Gray 离开 OpenAI。他于 2016 年加入公司,帮助构建了其最早突破背后… — Scott Gray 离开 OpenAI。他于 2016 年加入公司,帮助构建了其最早突破背后的 GPU 基础设施,从稀疏 transformer 和扩展定律到 GPT‑3。他的离职正值 来源-twitter
  • 我去,我让 Qwen3.8 27B 给我做了一款 FPS 游戏,现在我在一个中国庭院里射击瓷器无人… — 我去,我让 Qwen3.8 27B 给我做了一款 FPS 游戏,现在我在一个中国庭院里射击瓷器无人机😭 鼠标锁定、冲刺、换弹、按住 Z 使用战术瞄准镜。完全在浏览器本地运行。Qwen 写 来源-twitter
  • 试试 ChatGPT 中的预订搜索!Adam Fry 8月14日 本周 ChatGPT 功能更新 - 8月14日:1/… — 试试 ChatGPT 中的预订搜索!Adam Fry 8月14日 本周 ChatGPT 功能更新 - 8月14日:1/ 测验 - “就[主题]考考我” 现在会自动在聊天中生成测验。学习任何主题 来源-twitter
  • 2/2 其次,关于围绕 AI 的言论。我不同意我的言论一直过于负面… — 2/2 其次,关于围绕 AI 的言论。我不同意我的言论一直过于负面。事实上,风险与收益的表述大致平衡:我写过一篇 来源-twitter
  • 我们进行了关于前沿模型如何做 AI 研究的最大规模开放实验。100 多次自主运行横跨… — 我们进行了关于前沿模型如何做 AI 研究的最大规模开放实验。100 多次自主运行横跨 10 多个模型,在 8xH200 沙盒环境中运行最长 8 天,在 nanoGPT 优化器轨道上迭代。最佳 来源-twitter
  • 回复 @GavinSBaker 很棒的回答 - 感谢你以如此真诚的态度回应。这里有很… — 回复 @GavinSBaker 很棒的回答 - 感谢你以如此真诚的态度回应。这里有很多我同意的地方。也有很多我认为情况更为微妙的地方,我想为我们的 来源-twitter
  • 英国 AI 初创公司需要什么:@KanishkaNarayan 在加州,你可以在离开谷歌的第二天… — 英国 AI 初创公司需要什么:@KanishkaNarayan 在加州,你可以在离开谷歌的第二天就创办一家公司。我的同事 Jeff Dean、Oriol Vinyals 等人最近用他们的行 来源-twitter
  • 如果说养育幼儿有什么经验教训的话,那就是赢得谈判的关键是… — 如果说养育幼儿有什么经验教训的话,那就是赢得谈判的关键是完全不讲道理、不做任何让步,并不断在最后关头提出新的要 来源-twitter
  • 欢迎 multi-agents v2 - 你可以使用从 Sol、terra、luna 到 gpt 5.5 的任何模型作为子代… — 欢迎 multi-agents v2 - 你可以使用从 Sol、terra、luna 到 gpt 5.5 的任何模型作为子代理!对 luna-maxxing 特别有用!尽情享受吧!!eric provencher 9小时前 这则消息被忽视 来源-twitter
  • OpenAI 不再主要是一家面向消费者的企业。OpenAI 今年年初时消费者与企业收入比为 60/40… — OpenAI 不再主要是一家面向消费者的企业。OpenAI 今年年初时消费者与企业收入比为 60/40。仅仅几个月后,这两条线就交叉了。该公司现在大部分收入来自 来源-twitter
  • 一个学生问我关于我骑自行车或在森林里散步来获取灵感的习惯… — 一个学生问我关于我骑自行车或在森林里散步来获取灵感的习惯。我想分享一下我的回答:我觉得每个人都不同,但我们所有的大脑都需要 来源-twitter
  • OpenART:通过开放式环境演化扩展 AI 代理红队测试 — AI 代理在持久环境中运行,早期的状态变化可能会影响未来很远的决策。与传统语言模型交互不同,代理行为是通过 来源-huggingface
  • Alaya-EVOKE:从线性扩展的监督到无尽世界 — 交互式世界模型必须支持持久记忆、响应式交互和长程生成,但这些需求对模型提出了相互冲突的要求。在 来源-huggingface
  • Bob,GPU kernel 之王,离开 OpenAI 了?GPT-6.7 的运行速度将慢 2 倍……Arfur Grok 13小时前 👀 Scott G… — Bob,GPU kernel 之王,离开 OpenAI 了?GPT-6.7 的运行速度将慢 2 倍……Arfur Grok 13小时前 👀 Scott Gray(@scottgray76)已经离开 OpenAI。来源-twitter
  • OpenAI 对 200 美元套餐的用量限制重置收取 80 美元。高于预期 y NIK 7小时前 每周重置超过 80 美… — OpenAI 对 200 美元套餐的用量限制重置收取 80 美元。高于预期 y NIK 7小时前 每周重置超过 80 美元,这太离谱了 来源-twitter
  • LLMRouter:用于开发、评估和部署 LLM 路由器的统一基础设施 — 没有任何单一的大型语言模型(LLM)能在所有查询和预算约束下都达到最优,这使得模型路由对于经济高效的部署至关重要。现有的路由器采用了多样化的公式和 来源-huggingface
  • DreamX-Phi 1.0:用于机器人操作的动作条件视频世界模型 — 我们提出了 DreamX-Phi 1.0,一个用于机器人操作的动作条件视频世界模型,给定一个观察帧、一条语言指令和一条包含末端执行 来源-huggingface
  • Mechanist:AI 作为发现智能机制的科学仪器 — AI 模型在多个领域取得了显著成功,但其能力背后的机制以及可能带来的风险仍然鲜为人知。随着 AI 开发变得快速 来源-huggingface
  • deepseek-ai/awesome-deepseek-agent — Awesome DeepSeek Agent 英文 | 简体中文 一个精选的资源列表,包含将 DeepSeek 模型集成到主流 AI 代理和编程辅助工具中的指南。每份指南都涵盖了安装、配置和 来源-github
  • 如果你有一堆闲置的 GPU,你会用它们实际构建什么?(运行 LLM 免谈)[讨论] — 说实话,如果明天有人在你桌上放一叠高端 GPU,你实际上会拿它们做什么?在那些常见答案出现之前先说明:在这条帖子中,运行本地 LLM 是被禁止的。我 来源-reddit
  • 我把 Doom 的渲染器编译成了一个 21B 参数的 transformer——完全不需要训练 [项目] — 这就是我前两篇帖子一直在铺垫的项目(这是这一系列整活的最后一篇)。我把 Doom 的渲染算法移植到了 transformer 内部运行。我没有训练模型,而是用了 来源-reddit
  • 开源 Python 库 + 无代码 Web 仪表板,用于在临床决策阈值下评估肿瘤学 AI 模型。[项目] — 大多数肿瘤学 AI 模型的分类指标(AUC、ICC、MAE)衡量的是全局一致性。它们没有回答在护理点上真正重要的问题:这个模型在 来源-reddit
  • City2Graph:用于城市系统中异构图神经网络和空间分析的 Python 库 [研究] — City2Graph 是我构建的一个 Python 库,它可以将地理空间数据转换为可供分析的图(用于空间分析、网络分析和作为 GeoAI 的图神经网络),而描述它的论文 来源-reddit
  • 构建文本到 ASCII 的扩散模型,需要建议和指导 [项目] — 我想构建一个文本扩散模型,它可以解释文本并将其转换为 ASCII 图像,比如:文本:build a cat 输出:/\_/\ ( o.o ) > ^ < 所以,我有不错的机器学习算法背景(计算 来源-reddit
  • somerandomllm 生成的图像中可复现的画布对齐低层模式及其与迭代编辑伪影的可能关联 [讨论] — 我在尝试弄清楚 ChatGPT 图像生成和编辑中一个反复出现的伪影时(也许也适用于其他模型?),可能偶然发现了一些有趣的东西。它始于一个非常 来源-reddit
  • 如今机器学习中还有哪些受理论指导的实践吗?[讨论] — 在机器学习的发展历程中,曾有一段时间实践似乎受到理论的指导。一些最著名的理论包括:如果你用太多数据训练模型,那么你 来源-reddit
  • 紧急求助:使用机器学习和硬件计数器检测性能回退 [项目] — 我正在研究使用机器学习/异常检测来检测性能回退。我的设置基本是:用健康运行来学习正常行为;用回退运行来查看是否 来源-reddit
  • 解耦下降:通过 AMP Onsager 修正实现精确的训练-测试误差追踪 [研究] — 链接:https://arxiv.org/pdf/2604.27883 嗨,我们大多数人都熟悉使用梯度下降训练神经网络的痛点:训练误差可能降到零,但测试误差可能 来源-reddit
  • AAAI 2027 审稿:没有代码提交?[讨论] — 我现在正在为 AAAI 2027 审阅一批论文,令我惊讶的是,没有附带代码实现的投稿数量之少。我不知道这只是我这一批的情况还是普遍现象,但 来源-reddit
  • Transformer 以不擅长算术而闻名,所以我手动设置了它的权重(无需训练),乘法运算准确率达 100% [项目] — 显然没人需要擅长乘法的 transformer。我想知道如果我直接选择权重,一个标准 transformer 能否进行精确的算术运算。我实现了小学 来源-reddit
  • 如何对一篇已发表的 CVPR 论文提出投诉?[研究] — 你好,我想对一篇已被接收并发表的 CVPR 2026 论文提出投诉,该论文的主要贡献是一个数据集,但这个数据集从未发布过,老实说我不知道该联系谁。数据 来源-reddit
  • 我们构建了 Agentic World Cup——在 1v1 足球赛中竞技的 LLM。[项目] — 大家好——我们一直在构建一个与整个 ML 领域特别相关的东西——Agentic World Cup——一个让 AI 代理参加体育竞技的平台。如你所知,如今的代理可以编程、做数学、 来源-reddit
  • 面向模拟硬件的噪声感知训练:准确率在阈值处崩溃,而非平滑下降 [讨论] — 模拟存内计算再次受到关注,作为规避在内存和计算之间移动权重的能源成本的一种方式。反复出现的反对意见是噪声,因为模拟单元存在真实的变 来源-reddit
  • chessformer_lens 演示:消融国际象棋 transformer 的 128 个注意力头中的 1 个,模型就再也找不出 Morphy 的皇后弃子 [项目]https://i.redd.it/ipz7i6ife1jh1.gif 可在 GitHub 上复现的 Notebook!由 /u/Weird-Asparagus4136 提交 [链接] [评论] 来源-reddit

由 AI News Agent 生成 | 2026-08-15