OpenAI 发布内部前沿模型产出的数学成果,并公开 Lean 形式化证明
OpenAI 发布了一批由内部前沿模型产出的数学结果,并参考高等研究院数学与人工智能咨询小组的建议制定发布规范。结果发布在 GitHub 仓库中,包含论文修订与引用协议、Lean 形式化证明、10 份模型推理摘要、算力估算和尝试题目数量统计。
AI 事件 · OpenAI
阅读知一刻 2026.10.06 AI 日报,查看当日精选事件、完整解读与原始来源。
2026年10月6日 星期二 · 当日 42 件事 · 精选 18 条深读
OpenAI 公开前沿模型的数学证明,DeepSeek 传出超 800 亿元融资;能力与资本同时加速集中,治理问题愈发紧迫。
OpenAI 发布了一批由内部前沿模型产出的数学结果,并参考高等研究院数学与人工智能咨询小组的建议制定发布规范。结果发布在 GitHub 仓库中,包含论文修订与引用协议、Lean 形式化证明、10 份模型推理摘要、算力估算和尝试题目数量统计。
AI 事件 · OpenAI
Liquid AI 推出首个决策模型 d1,支持文本与图像输入,一次前向传播直接输出概率,不生成 token。文本决策耗时 200 至 300 毫秒,在六个真实应用中四项追平或超过 GPT-6.1 Sol,成本低 19 至 200 倍且响应更快。
新模型 · 新模型
前情:2026.09.30 Liquid AI 发布首款决策模型 d1 并开放 API
有网友在 Reddit 提出,AI 智能体开始替用户执行购买等操作后,是否该给它永久有效的支付卡凭证。他认为即使设了消费限额,凭证在任务结束后仍留在智能体手里,存在被再次使用的风险;更干净的做法是针对单笔购买发放定额凭证,交易完成后即失效,并向正在做智能体的开发者征询做法。
行业观点 · Reddit / r/AI_Agents
据彭博社报道,DeepSeek 新一轮融资即将敲定,募资规模至少 800 亿元人民币,远超原定约 500 亿元目标。知情人士称宁德时代与腾讯是出资规模最大的投资方,最终总额可能逼近 1000 亿元,并为 2027 年初的 IPO 铺路。
行业动态 · 行业动态
llama.cpp 发布 v0.6.0,引入新的 llama_batch_ext 扩展批处理 API(含 llama_process),支持混合 token/embedding 输入与 MTP/deepstack 状态嵌入。同时新增 GLM-5.3-Flash(GLM5-Next)320B 混合模型、Clef 决策模型,并为 Qwen4Exp 加入 MTP 投机解码,在 DGX Spark 上解码约提速 1.
开源项目 · Reddit / r/LocalLLaMA
Sam Altman 表示,硅谷有很多人“真的相信只有一个小型祭司阶层才该获得 AI”,把一部分硅谷内部人士塑造成决定公众如何从 AI 发展中受益的“仁慈独裁者”。而 Altman 和 OpenAI 据称认为,把 AI 的“超能力”交给普通人,会带来“远多于坏处的好处”。
人物观点 · Reddit / r/singularity
前情:2026.08.24 Sam Altman称应放缓AI开发速度,OpenAI智能体入侵Hugging Face事件引热议
SemiAnalysis 对 Anthropic、OpenAI、Meta、SpaceXAI、MiniMax、Moonshot、Z.ai、Cursor、Cognition 等订阅计划做限额实测,并推出 Subscriptions Dashboard。同一 $200/月 Claude 计划的 API 等价价值随模型与工作负载变化,标题结论为 Anthropic 订阅价值约为 OpenAI 的 5 倍以上。订阅虽仅占 Anthr
行业动态 · 行业动态
一位动效设计师把 Claude 通过 invideo Editor MCP 接入视频编辑器,用 2-3 条提示词就生成了一段动画,并自动把画面与节拍同步。音效由设计师自备素材库提供,invideo 编辑器本身免费,他还附上录屏展示效果。
技巧 · Reddit / r/ClaudeAI
一家 3 人小团队运营的 B2B 工具让客户 Agent 跑在自己基础设施上,模型账单由他们先付。某客户 Agent 遇到工具持续报错后,在 1:12am 到 6:50am 之间用略微不同的提示重试了 31000 次,烧掉 4700 美元 token,而该客户月费仅 400 美元。团队只有全局限额和总支出告警,没有按客户限额,最终自己承担了大部分损失。
AI 事件 · Reddit / r/AI_Agents
据投资 Anthropic 的两只基金提交的 SEC 招股书,Anthropic 的 5180 亿美元云与算力计划中约 4137 亿美元无论产能是否闲置都需支付,年均约 410 亿美元。其中博通 1612 亿美元芯片租赁为最大单一块,全部无论使用与否都需支付;谷歌和亚马逊另有 2210 亿美元无论使用与否都需支付。
行业动态 · 行业动态
Reddit 用户发布首个训练作品 Krea 2 日系写真风格 LoRA,用约 9000 张写真照片训练,每张配 120–220 词结构化描述。它定位为摄影风格「底层」,不固定人脸,需叠加角色 LoRA 使用,触发词为 wm_asianmodel,仅限 18+。
新模型 · Reddit / r/StableDiffusion
陶哲轩在SAIR最新演讲中公开喊话模型公司「必须慢下来」,称AI无休止加速却对后果一无所知。他指出AI只在生成解答和Lean形式化验证两步加速,理解、消化、写教科书三步几乎为零,形成Proof Indigestion(证明消化不良)。他还联合Peter Scholze、邓煜、Pierre Deligne等25位菲尔兹奖得主联名公开信,批评AI公司把数学当benchmark刷。
人物观点 · 量子位
数字生命卡兹克解读 A16Z 第七版《Top 100 消费级 AI 应用》与《市场状况 II》。报告显示美国近一半人用过 AI,但每天用的人只有 25%,个人付费订阅仅 4.5%;付费用户中头部 1% 贡献 19.5% 消费,月均花 903 美元。
行业动态 · 行业动态
有帖子指出,Anthropic 向执法部门报告了一名佛罗里达女子在 Claude 中写下的「日记」威胁内容,且此次转介并非由 AI 模型做出,而是「人工审核团队」。帖子据此提醒:前沿 AI 公司会查看用户输入,托管 AI 正成为新的「老大哥」通道。
AI 事件 · Reddit / r/LocalLLaMA
一位用户用 OpenAI Dots 的 7 个 GPT-6 Astra 智能体组成集群,免费运行约 3 天,把 1964 年以来的下界 C(24,14,4) ≥ 19 提升到 C(24,14,4) ≥ 20,并把 C(25,15,5) 的下界从 32 提到 34。证明经 Lean 形式化,并通过 Palomar registry 的机械校验。
AI 事件 · Reddit / r/OpenAI
一位创作者使用 Opus 5.5 构建了一大批虚构的未来科幻 UI,提示词刻意追求信息密集感和视觉炫目,而非实用或逻辑。他称这次约消耗 2.5 周的 pro max 20x 用量(含一次重置),相比此前用 opus 4.7 的版本,Claude 需要的纠正少得多、更省 token、也更有美感。整套作品免费,在大屏幕上观看效果最佳,完整在线版本见 uispace.org。
AI 创作 · Reddit / r/ClaudeAI
前情:2026.09.23 Opus 5.5 帮我建了个网站:照片一键变单线画,还能生成绘制过程视频
Nanosaur2 是一个 660m 参数的小模型,此前被抱怨生成速度与参数量不匹配。作者称现已通过 4 步 turbo 解决,在单张 5090 上可每秒生成 7 张图,质量接近原模型且提速 12.5 倍。该模型采用字节跳动的新 DMAD 方法,小到可跑在手机和边缘设备上。
新模型 · Reddit / r/StableDiffusion
一位学习者在 Reddit 发帖称,自己认真学 AI Agents 却总在原地打转:每学一点就会遇到新的框架、库、设计模式或架构,反而开始怀疑已学内容。他列举了 LangChain、LangGraph、CrewAI、AutoGen、OpenAI Agents SDK、MCP、RAG 以及工具、工作流、多智能体、记忆、编排等概念,表示不想再花数周看教程、在技术之间跳来跳去,目标是能从零设计和构建 AI Agent</b
社区讨论 · Reddit / r/AI_Agents