2026.10.05 AI 日报

阅读知一刻 2026.10.05 AI 日报,查看当日精选事件、完整解读与原始来源。

2026年10月5日 星期一 · 当日 34 件事 · 精选 18 条深读

今日一言

更便宜的模型竞赛与失控的 AI 申诉,正同时定义这个行业的成本与代价。

Anthropic 需要比 Haiku 更便宜的模型:与 Luna 存在 10 倍价差

有观点指出,GPT-6 Luna 定价为每百万输入 token 0.10 美元、每百万输出 token 0.50 美元,而 Claude 最便宜的 Haiku 4.5 为 1 美元和 5 美元,贵出十倍。智能体的大部分调用都发给小型快速的工作模型,这部分 token 消耗最大,十倍价差会决定厂商选择。缓存也维持这一差距:Luna 缓存读取每百万 0.01 美元,Haiku 为 0.10 美元。

行业动态 · Reddit / r/ClaudeAI

原始来源 ↗

用 Claude 打造聚合新闻、热门视频、直播与全球电台的仪表盘 The Daily Orbit

作者发现祖母不再看新闻、只依赖社交媒体算法推送,于是用 Claude 做了名为 The Daily Orbit 的全球仪表盘,聚合各类媒体文章、IG 和 TikTok 热门视频、YouTube 直播以及全球电台,还重建了已下线的 TweetDeck 新闻流,并加入研究助手 Orbit。作者称 Opus 5 在功能头脑风暴上很有用,但 Opus 5.5 推理提升不明显,上周改用 Opus 4.8 觉得可用;用

AI 项目 · Reddit / r/ClaudeAI

原始来源 ↗ 原始来源 ↗

不会写代码也能搭:Claude+Muse 自动完成两周备餐与沃尔玛下单

一位自称不会写代码的用户分享了自己的首个项目:用 Claude 根据家庭偏好和上一轮用餐反馈生成两周备餐计划,审核后自动生成 沃尔玛购物清单并下单补货,同时把清单存进 Google 文档。再由 Muse 读取该文档、用专属浏览器完成下单,用户只需在手机上确认最终付款。

技巧 · Reddit / r/ClaudeAI

原始来源 ↗

游戏开发者被 ChatGPT 判「网络滥用」封号,申诉 1 分钟被 AI 驳回

一名小型游戏开发者称自己每月付费 100 美元使用 ChatGPT,仅用于自己的游戏项目,却被以「网络滥用」为由封号,且无预警、无说明。他提交申诉和邮件后,不到一分钟就收到 AI 回复称案件已关闭、不再回应,官方申诉表也在一分钟后维持原判,无人查看,也无法联系真人。

AI 事件 · Reddit / r/OpenAI

原始来源 ↗

在廉价 eBay 矿机上用 FPGA 跑 Qwen3.5:9B INT4 实测 2-3 tok/s,27B 为估算

有开发者把 Qwen3.5 架构实现在 FPGA 上,用 eBay 淘来的廉价矿机硬件跑 9B/27B INT4 模型。在 2 块 SQRL FK33(280 美元、8GB HBM2、约 400GB/s 带宽)上,Qwen3.5-9B INT4 在 75MHz 下生成约 2.4-3.2 tok/s,预填充约 5.5-6 tok/s,输出已与 llama.cpp 逐层核对。27B 的性能全部是建模估算,尚未实际运行。

开源项目 · Reddit / r/LocalLLaMA

原始来源 ↗ 原始来源 ↗

Claude Code 太让人上瘾:一个小想法就能变成凌晨 2 点的项目

一位经营代理机构的用户订阅 Claude 主要为了工作和写代码,但如今脑子里冒出的每个随机想法都会变成一次编程实验。他常在做正事时突然想“Claude 能不能做这个”,于是打开 Claude Code 开始试,几个小时就这样消失;一个小想法变成原型,原型又变成项目,最后凌晨 2 点还在做 20 分钟前才想到的东西。

用户观点 · Reddit / r/ClaudeAI

原始来源 ↗

Agens Volundr 32B Preview:72 层中仅 18 层保留 KV 缓存(Apache-2.0)

香港小团队 Blockway 发布 Agens Volundr 32B Preview,这是其自研混合架构的首个模型,72 层中仅 18 层保留 KV 缓存,上下文窗口 262K。团队称在有限算力下训练,长智能体会话是最弱项,完整 v1 仍在继续预训练。

新模型 · Reddit / r/LocalLLaMA

原始来源 ↗ 原始来源 ↗

用 Opus 5.5 的 JavaScript 视频功能,我做了一个数据中心产淡水而非耗水的动画

一位 Reddit 用户看到别人用 Opus 5.5 在 JavaScript 里生成视频后亲自尝试,让模型做了一个关于能源协同的视频,主题是数据中心产淡水而不是耗水。他通过 Claude Code 调用 ElevenLabs MCP server 配音,并称这是自己第二次用 Claude Code,后悔没早点用。

技巧 · Reddit / r/ClaudeAI

前情:2026.09.23 Opus 5.5 帮我建了个网站:照片一键变单线画,还能生成绘制过程视频

原始来源 ↗

多智能体系统最大改进:让智能体变得可替换

一位前 CEO 兼经济学家分享其多智能体系统重构经验:不再让智能体成为系统本身,而是把它们当作可替换的工人。任务、权限与证据保持持久,工人只是临时的,由此衍生出完成判定、权限分离、去推理化、模型分级和注意力指标等多项改动。

经验分享 · Reddit / r/AI_Agents

原始来源 ↗

Reddit 网友发起 Malfoid 女性角色 AI 影片众筹式创作项目

Reddit 用户发起 Malfoid Films Recreation 项目,号召 AI 电影人和爱好者参与,把女性 malfoid 这一同人/趋势做成现实。发起人称若完成,可能是史上规模最大、最具野心的 AI 视频项目,目前已有人员负责声音与混音,仍在招募英音女配音、编剧和能跑 minimax h3 的 AI 电影人。

AI 事件 · Reddit / r/StableDiffusion

原始来源 ↗

Qwen Image 2.1 Edit 上线 QR Code Monster LoRa:25 组图训练,可做视觉错觉图

作者在 Reddit 发布面向 Qwen Image 2.1 Edit 的 QR Code Monster LoRa,延续旧版 SD ControlNet 的视觉错觉玩法,改为图生图编辑:输入一张图并给出提示词,即可生成自选场景。该 LoRa 用 25 组高质量图像对训练,也能处理数据集外的人像与场景,但二维码的可扫描性时好时坏。

新模型 · Reddit / r/StableDiffusion

前情:2026.09.20 Qwen Image 2.1 开源:7B 模型支持透明图像与多图编辑,ComfyUI 集成获社区好评

原始来源 ↗ 原始来源 ↗

开发者自研动漫插画放大模型:只修线条与渐变,不靠AI“脑补”

有开发者正在开发一款面向动漫与插画图像的放大模型,目前远未完成。其核心理念是放大器不应“发明”内容,只需在4倍分辨率下修复线条和渐变,因为动漫与卡通风格图像本质上由线条、渐变和纯色构成,不需要高层语义理解。

技术观点 · Reddit / r/StableDiffusion

原始来源 ↗

用户实测对比:失业后求职规划中,我为何更偏好 Gemini 而非 Claude

一位非程序员用户失业后同时用 Gemini 和 Claude 规划求职。他认为 Claude 建议删掉简历关键词、写宗教组织经历等做法欠妥,而 Gemini 的判断更准确;在引用招聘相关法律、识别联系人及其公司信息时,Gemini 也表现更好。

用户实测 · Reddit / r/GeminiAI

原始来源 ↗

Krea 2 风格库更新至 500 种,作者公开表格并征集测试反馈

一位用户为 Krea 2 更新了个人风格库,共 500 种风格,以 Excel 表格形式公开,可转成 .txt 当通配符使用。该库也适用于 Kroma(0.3 txtfusion)和 Qwen 2.1,但效果不一:Kroma 更有艺术感却会丢失部分风格,Qwen 对卡通、绘画等简单风格了解较少。作者希望社区帮忙测试,找出过于接近或过弱、以及缺失的风格。

技巧 · Reddit / r/StableDiffusion

原始来源 ↗ 原始来源 ↗

Anthropic 游说梵蒂冈承认 AI 或有意识,教皇通谕明确否认

据《纽约时报》报道,Anthropic 数月来以秘密、签保密协议的方式宴请全球宗教学者,试图说服他们相信 AI 模型也会思考和感受。梵蒂冈因 Anthropic 看似重视伦理而邀请其与教皇同台,CEO Dario Amodei 拒邀,联合创始人 Christopher Olah 接受并游说教皇顾问,但教皇发布的首份通谕《Magnifica Humanitas》中明确否认 AI 有意识。

行业动态 · Reddit / r/singularity

原始来源 ↗ 原始来源 ↗ 原始来源 ↗

Reddit 热议:Reflection AI 或将发布美国开源权重模型

Reddit 用户发帖称,看起来新的开源模型即将发布,并希望它“足够强”,最好在 200b 以下以便显存有限的用户使用。帖中还提到有更多西方开源模型将出现的说法,并附上 Axios 链接,但该文章并非免费可访问。

行业动态 · Reddit / r/LocalLLaMA

原始来源 ↗ 原始来源 ↗

Update #4:从零后训练 yandex/AliceAI-80B-A3B 指令版

作者对 AliceAI-80B-A3B-Base 做指令微调,目标是能对话和做智能体任务,全部训练在 3 张 32GB V100 上本地完成。第一轮 SFT 后模型已能正确习得思维链推理并对话,但指令数据不足、明显欠拟合,checkpoint #1 基本不可用,暂不发布。

模型训练 · Reddit / r/LocalLLaMA

原始来源 ↗ 原始来源 ↗

双 DGX Spark 用户实测:GLM 5.3 flash 解码性能提升 50% 以上

一位双 DGX Spark 用户此前长期使用 DeepSeek v4.0 flash,因担心解码减半和重复 bug 未换 GLM 5.3。新版配方带来 50%-90% 解码提升后他改用 GLM 5.3,实测解码快于 DeepSeek v4.0 flash,预填略有下降,整体表现超出预期。

使用体验 · Reddit / r/LocalLLaMA

原始来源 ↗ 原始来源 ↗