2026.10.01 AI 日报

阅读知一刻 2026.10.01 AI 日报,查看当日精选事件、完整解读与原始来源。

2026年10月1日 星期四 · 当日 45 件事 · 精选 18 条深读

今日一言

GPT-6.1 以低价逼近前沿编码能力,视频人物替换与 Agent 榜单同步推进;本地推理的成本账,也开始被认真计算。

OpenAI 发布 GPT-6.1 Sol:以 Astra 五分之一价格接近其编码与计算机操作水平

OpenAI 发布 GPT-6 家族中端模型 GPT-6.1 Sol,在智能体编码、电脑操作和专业工作上接近 Astra,价格仅为 Astra 标准输入输出的五分之一。缓存输入降至每百万 token 0.10 美元,比 GPT-6 Sol 低 50%,现已上线 API、ChatGPT Work 和 Codex。

新模型 · 新模型

原始来源 ↗

用 H3 精准替换视频中一个人:保留拥抱、摘墨镜与唇形同步

作者称这是他尝试过最难的项目之一:只替换视频中的一个人,同时保留拥抱等互动,并完成摘墨镜和唇形同步。全部由自建智能体 AI 系统负责协调与质检,使用自建 minimax H3 工作流,由自建渲染调度分发器在本地与按需 GPU 池上渲染,全程从 iPhone 监控和调度。

技巧 · Reddit / r/comfyui

原始来源 ↗

Gemini 4 Argon (High) 登 Arena Agent Arena 第 8 名,净提升 +7.92%

Arena.ai 公布,Gemini 4 Argon (High) 在 Agent Arena 排名第 8,净提升 +7.92%,并以 每任务 0.62 美元重塑帕累托前沿。它比第 19 名、净提升 +2.96% 的 Gemini 3.8 Flash (High) 高出 4.96 个百分点,在可控性、确认成功等信号上表现突出。

行业动态 · 行业动态

原始来源 ↗

Reddit 用户质疑 Claude 为何能搜到《守望先锋》治疗量数据

一名首次在 Reddit 发帖的用户称,自己让 Claude Opus 5.5(推理强度 Max)计算《守望先锋》体育场模式中哪个治疗者与搭配 perk 治疗量最高,并要求给出 Brigitte、Mercy 以及持续治疗和爆发治疗最强角色。用户原以为模型会引用可靠来源,但质疑为何这类内容没有被标记跳过。

用户反馈 · Reddit / r/ClaudeAI

原始来源 ↗

开发者周末用 TypeScript 做出「摧毁任意网站」火柴人沙盒游戏

一位 TypeScript 开发者在周末完成了自己的梦想项目:一款火柴人破坏沙盒游戏,灵感来自《Animator Vs. Animation》。玩家输入一个网站 URL,页面就会变成可破坏的关卡,用武器摧毁一切,并支持多人联机。技术栈为 TypeScript 自研引擎与 Canvas 2D 渲染,联机用 Cloudflare Durable Objects,托管在 Cloudflare Workers。

开源项目 · Reddit / r/ClaudeAI

原始来源 ↗ 原始来源 ↗

用7900XTX跑本地AI每小时电费0.12€,比用前沿模型更便宜吗?

一位用户用7900XTX加9800x3D本地跑Qwen flash或Qwen 27b dense,当地电价0.25€/kWh(区间0.11€~0.35€),借ChatGPT算出每小时AI成本约0.12€。他据此发问:若deepseek flash每百万token更快,是否说明前沿模型对自己更便宜,还是自己算错了。

成本讨论 · Reddit / r/LocalLLaMA

原始来源 ↗

Google DeepMind 发布 Gemini 4 Argon,面向可信网络防御者先行开放

Google DeepMind 发布新一代前沿模型 Gemini 4 Argon,先通过 Fairwind 计划向一批可信网络防御者开放。该模型面向长周期复杂任务,输出上限提升至 100 万 token,在软件工程、法律金融等企业知识工作和网络安全防御中表现前沿。

新模型 · Reddit / r/GeminiAI

前情:2026.09.03 Google DeepMind发布WeatherNext 3气象大模型,每小时刷新与5公里高精度全球预报

原始来源 ↗ 原始来源 ↗ 原始来源 ↗

ComfyUI-RMBG v3.2.0 发布:新增分辨率选择器与图像对比节点,启动提速至 0.1 秒内

ComfyUI-RMBG 发布 v3.2.0,新增 Resolution Selector 和 Image Compare View 两个节点,并修复了 transformers 5.0 兼容性、批处理尺寸不匹配等问题。所有加载大模型的节点新增可选的 unload_model 开关,启动时间从约 15 秒降至 0.1 秒以内。

开源项目 · Reddit / r/comfyui

原始来源 ↗ 原始来源 ↗

ChatGPT 现可直接构建并部署 MCP 服务器

Tibo 表示,用户现在可以直接通过 ChatGPT 构建并部署 MCP 服务器,并可将访问权限限制给指定对象或向全世界共享。Max Stoiber 同时宣布,ChatGPT Sites 可托管 MCP 服务器,并支持插件扩展,例如通过 @sites 创建一个可在 ChatGPT 中使用的待办清单。

功能更新 · 功能更新

原始来源 ↗

我告诉 Claude 我喜欢巴赫和合成器:Opus 5.5 创作 Contrapunctus Acidus

一位用户在与 Claude Code(Opus 5.5)打磨游戏生成式配乐时,让 Claude 开一个支线任务,用同一套 Rust/FunDSP 合成引擎创作一首约 2 分钟的硬核合成器巴洛克作品。Claude 把乐谱写成程序,用脚本检查对位,再用自己写的 FunDSP 引擎渲染,因无法听音而靠测量结果多轮修正,最终产出 Contrapunctus Acidus 及可视化。

AI 事件 · Reddit / r/ClaudeAI

前情:2026.09.23 Opus 5.5 帮我建了个网站:照片一键变单线画,还能生成绘制过程视频

原始来源 ↗ 原始来源 ↗

286 老电脑跑通 AI 对话与画图:Tandy 1000 TL/3 上的 DeskMind

作者在 Tandy 1000 TL/3(10 MHz 286、640K、Tandy Video II)上运行 DOS 程序 DeskMind,经 PicoMEM 2 网卡和 mTCP 连到 PC 上的 Python 服务器 MindServer,由服务器驱动 Qwen3.8-27B 与 Krea 2。286 只收纯文本行和可直接写入显存的图片,从不接触 JSON、base64 或 PNG。

开源项目 · Reddit / r/LocalLLaMA

原始来源 ↗ 原始来源 ↗ 原始来源 ↗

Reddit 用户质疑 Opus 5.5 上线后被暗中降级,并讨论如何测量与维权

一名 Reddit 用户称 Opus 5.5 上线前 5-6 天表现极佳,随后突然在简单任务上出错、回复风格异常,此后质量再未恢复。他建议在新模型发布时保存提示词与测试结果,日后复测并同时记录响应速度,还援引欧盟《数字内容指令》认为若服务与宣传不符可要求退款。

行业动态 · Reddit / r/ClaudeAI

原始来源 ↗

GPT-6.1 Sol (Max) 以 1759 分登上 Code Arena: WebDev 第 3 名

OpenAI 的 GPT-6.1 Sol (Max) 在 Code Arena: WebDev 榜单上以 1759 分排名第 3,混合价格 8 美元/百万 Token。相比 GPT-6 Sol (Max),同价下提升 70 分,总排名上升 4 位,并在全部七个细分品类中均有提升。

新模型 · 新模型

原始来源 ↗

Reddit 用户实测 RefMods:无需标签即可为 MH3 生成角色 LoRA 与语音克隆

一位 Reddit 用户分享使用 RefMods for MH3 的体验,称此前尝试过角色图、character-sheets、i2v 以及为 Krea2 训练 LoRA,都不如 RefMods。无需任何标签,用一批图片就能快速生成可长期使用的 safetensors 文件,人脸相似度很高且无失真;把 mp3 语音放进同一文件夹,还能在同一个 safetensors 里生成近乎 1:1 的语音克隆。作者还更新

技巧 · Reddit / r/StableDiffusion

原始来源 ↗ 原始来源 ↗

MiniMax H3 X2 Detail VAE:一次失败实验带来的 2 合 1 视频 VAE 发布

作者为 MiniMax H3 VAE 尝试做 2X 细节增强,希望放大后能包含真实新增细节,但最终发现普通生成的 H3 latent 本身不含这些额外信息,原目标未达成。不过实验产出了可用成果,打包为 2 合 1 发布:2X VAE 模式用于普通 H3 生成,2X VAE + Detailed 模式用于参考图/图生视频流程,并附带模型、ComfyUI 节点、工作流和视频对比。

开源项目 · Reddit / r/StableDiffusion

前情:2026.08.08 MiniMax开源新一代通用视频模型 MiniMax H3

原始来源 ↗ 原始来源 ↗

Viggle turbo v0.3 适配 Qwen image 2.1:颗粒更少、表面更干净

Viggle turbo v0.3 面向 Qwen image 2.1 发布,6 步模式下相比 v0.2.1 颗粒更少、表面更干净,但细腻纹理略软,多样性与小字准确度基本持平。新增 9 步模式:先跑 7 个 turbo 步,再关掉 LoRA 由基础模型完成最后两步,细节更细、小字更常正确,耗时约为 6 步的 1.4–1.5 倍。

功能更新 · Reddit / r/StableDiffusion

前情:2026.09.20 Qwen Image 2.1 开源:7B 模型支持透明图像与多图编辑,ComfyUI 集成获社区好评

原始来源 ↗ 原始来源 ↗

MiniMax 搭配环绕 LoRA 与首尾帧,360 度环绕运镜效果惊艳

Reddit 用户分享在 MiniMax 上使用 环绕 LoRA 配合首尾帧的玩法,效果被评价为非常出色。其提示词要求画面只保留一个冻结瞬间、仅相机做连续 360 度环绕,人物与物体保持位置、朝向、形状和姿态不变,空中物体悬停,人脸、手、衣物、液体和背景静止,仅靠相机视差产生运动感,且不允许剪辑、变焦、变形或新增物体。

技巧 · Reddit / r/StableDiffusion

原始来源 ↗ 原始来源 ↗

Reddit 网友装齐 4 张 Tesla T4,本地推理机达 64GB 显存

一位 Reddit 网友晒出自己组装完成的本地推理主机:4 张 Tesla T4 16GB 显卡,合计 64GB 显存,搭配 SuperMicro X11SPA-T 主板、Xeon W3225 和 768GB DDR4 ECC 内存。他原本打算升级 CPU,但对比旧机器上核心更多的 CPU 后速度表现很好,认为升级不会有差别。

硬件装机 · Reddit / r/LocalLLaMA

原始来源 ↗