{"no":1004,"date":"2026.10.05","weekday":"星期一","cn_date":"2026年10月5日 星期一","total":34,"rest":16,"one_line":"更便宜的模型竞赛与失控的 AI 申诉，正同时定义这个行业的成本与代价。","cover":null,"items":[{"n":1,"type":"行业动态","src":"Reddit / r/ClaudeAI","title":"Anthropic 需要比 Haiku 更便宜的模型：与 Luna 存在 10 倍价差","sum":"有观点指出，<b>GPT-6 Luna 定价为每百万输入 token 0.10 美元、每百万输出 token 0.50 美元</b>，而 Claude 最便宜的 Haiku 4.5 为 1 美元和 5 美元，<b>贵出十倍</b>。智能体的大部分调用都发给小型快速的工作模型，这部分 token 消耗最大，十倍价差会决定厂商选择。缓存也维持这一差距：Luna 缓存读取每百万 0.01 美元，Haiku 为 0.10 美元。","img":"","links":[{"url":"https://www.reddit.com/r/ClaudeAI/comments/1wxsns4/anthropic_needs_an_even_cheaper_model_than_haiku/"}],"section":"models","prior":null},{"n":2,"type":"AI 项目","src":"Reddit / r/ClaudeAI","title":"用 Claude 打造聚合新闻、热门视频、直播与全球电台的仪表盘 The Daily Orbit","sum":"作者发现祖母不再看新闻、只依赖社交媒体算法推送，于是用 <b>Claude</b> 做了名为 <b>The Daily Orbit</b> 的全球仪表盘，聚合各类媒体文章、IG 和 TikTok 热门视频、YouTube 直播以及全球电台，还重建了已下线的 TweetDeck 新闻流，并加入研究助手 Orbit。作者称 Opus 5 在功能头脑风暴上很有用，但 Opus 5.5 推理提升不明显，上周改用 Opus 4.8 觉得可用；用 ","img":"","links":[{"url":"https://dailyorbit.news/"},{"url":"https://www.reddit.com/r/ClaudeAI/comments/1wxnkuc/i_used_claude_to_build_a_dashboard_that/"}],"section":"creative","prior":null},{"n":3,"type":"技巧","src":"Reddit / r/ClaudeAI","title":"不会写代码也能搭：Claude+Muse 自动完成两周备餐与沃尔玛下单","sum":"一位自称不会写代码的用户分享了自己的首个项目：用 <b>Claude</b> 根据家庭偏好和上一轮用餐反馈生成两周备餐计划，审核后自动生成 <b>沃尔玛</b>购物清单并下单补货，同时把清单存进 Google 文档。再由 <b>Muse</b> 读取该文档、用专属浏览器完成下单，用户只需在手机上确认最终付款。","img":"","links":[{"url":"https://www.reddit.com/r/ClaudeAI/comments/1wxlm01/ai_is_a_hellofresh_killer_automated_meal_prep_and/"}],"section":"agents","prior":null},{"n":4,"type":"AI 事件","src":"Reddit / r/OpenAI","title":"游戏开发者被 ChatGPT 判「网络滥用」封号，申诉 1 分钟被 AI 驳回","sum":"一名小型游戏开发者称自己每月付费 <b>100 美元</b>使用 ChatGPT，仅用于自己的游戏项目，却被以「网络滥用」为由封号，且无预警、无说明。他提交申诉和邮件后，<b>不到一分钟</b>就收到 AI 回复称案件已关闭、不再回应，官方申诉表也在<b>一分钟后</b>维持原判，无人查看，也无法联系真人。","img":"","links":[{"url":"https://www.reddit.com/r/OpenAI/comments/1wxnt4u/banned_from_chatgpt_for_cyber_abuse_while/"}],"section":"products","prior":null},{"n":5,"type":"开源项目","src":"Reddit / r/LocalLLaMA","title":"在廉价 eBay 矿机上用 FPGA 跑 Qwen3.5：9B INT4 实测 2-3 tok/s，27B 为估算","sum":"有开发者把 Qwen3.5 架构实现在 FPGA 上，用 eBay 淘来的廉价矿机硬件跑 9B/27B INT4 模型。在 2 块 SQRL FK33（280 美元、8GB HBM2、约 400GB/s 带宽）上，<b>Qwen3.5-9B INT4 在 75MHz 下生成约 2.4-3.2 tok/s</b>，预填充约 5.5-6 tok/s，输出已与 llama.cpp 逐层核对。27B 的性能全部是建模估算，尚未实际运行。","img":"","links":[{"url":"https://github.com/Nero7991/llm.vhdl/blob/fpga/docs/2026-09-24_asic-and-shuttle-feasibility.md"},{"url":"https://www.reddit.com/r/LocalLLaMA/comments/1wxken1/qwen35_arch_implementation_in_fpga_fabric_for/"}],"section":"research","prior":null},{"n":6,"type":"用户观点","src":"Reddit / r/ClaudeAI","title":"Claude Code 太让人上瘾：一个小想法就能变成凌晨 2 点的项目","sum":"一位经营代理机构的用户订阅 Claude 主要为了工作和写代码，但如今脑子里冒出的每个随机想法都会变成一次编程实验。他常在做正事时突然想“Claude 能不能做这个”，于是打开 Claude Code 开始试，<b>几个小时就这样消失</b>；一个小想法变成原型，原型又变成项目，最后<b>凌晨 2 点还在做 20 分钟前才想到的东西</b>。","img":"","links":[{"url":"https://www.reddit.com/r/ClaudeAI/comments/1wxt8wo/claude_code_is_very_addictive/"}],"section":"voices","prior":null},{"n":7,"type":"新模型","src":"Reddit / r/LocalLLaMA","title":"Agens Volundr 32B Preview：72 层中仅 18 层保留 KV 缓存（Apache-2.0）","sum":"香港小团队 Blockway 发布 <b>Agens Volundr 32B Preview</b>，这是其自研混合架构的首个模型，72 层中仅 18 层保留 KV 缓存，上下文窗口 262K。团队称在有限算力下训练，长智能体会话是最弱项，完整 v1 仍在继续预训练。","img":"media/2026.10.05/23.jpg","links":[{"url":"https://huggingface.co/Blockway/Agens-Volundr-32B-Preview"},{"url":"https://www.reddit.com/r/LocalLLaMA/comments/1wy7wn0/agens_volundr_32b_preview_our_small_teams_first/"}],"section":"models","prior":null},{"n":8,"type":"技巧","src":"Reddit / r/ClaudeAI","title":"用 Opus 5.5 的 JavaScript 视频功能，我做了一个数据中心产淡水而非耗水的动画","sum":"一位 Reddit 用户看到别人用 <b>Opus 5.5</b> 在 JavaScript 里生成视频后亲自尝试，让模型做了一个关于<b>能源协同</b>的视频，主题是数据中心产淡水而不是耗水。他通过 <b>Claude Code</b> 调用 <b>ElevenLabs MCP server</b> 配音，并称这是自己第二次用 Claude Code，后悔没早点用。","img":"","links":[{"url":"https://www.reddit.com/r/ClaudeAI/comments/1wxy24q/i_had_to_try_opus_55s_javascript_videos_so_i_made/"}],"section":"creative","prior":{"date":"2026.09.23","title":"Opus 5.5 帮我建了个网站：照片一键变单线画，还能生成绘制过程视频"}},{"n":9,"type":"经验分享","src":"Reddit / r/AI_Agents","title":"多智能体系统最大改进：让智能体变得可替换","sum":"一位前 CEO 兼经济学家分享其多智能体系统重构经验：不再让智能体成为系统本身，而是把它们当作<b>可替换的工人</b>。任务、权限与证据保持持久，工人只是临时的，由此衍生出完成判定、权限分离、去推理化、模型分级和注意力指标等多项改动。","img":"","links":[{"url":"https://www.reddit.com/r/AI_Agents/comments/1wxndo3/the_biggest_improvement_to_my_multiagent_system/"}],"section":"agents","prior":null},{"n":10,"type":"AI 事件","src":"Reddit / r/StableDiffusion","title":"Reddit 网友发起 Malfoid 女性角色 AI 影片众筹式创作项目","sum":"Reddit 用户发起 <b>Malfoid Films Recreation</b> 项目，号召 AI 电影人和爱好者参与，把女性 malfoid 这一同人/趋势做成现实。发起人称若完成，可能是<b>史上规模最大、最具野心的 AI 视频项目</b>，目前已有人员负责声音与混音，仍在招募英音女配音、编剧和能跑 minimax h3 的 AI 电影人。","img":"","links":[{"url":"https://www.reddit.com/r/StableDiffusion/comments/1wxnohj/malfoid_films_recreation/"}],"section":"products","prior":null},{"n":11,"type":"新模型","src":"Reddit / r/StableDiffusion","title":"Qwen Image 2.1 Edit 上线 QR Code Monster LoRa：25 组图训练，可做视觉错觉图","sum":"作者在 Reddit 发布面向 <b>Qwen Image 2.1 Edit</b> 的 QR Code Monster LoRa，延续旧版 SD ControlNet 的视觉错觉玩法，改为图生图编辑：输入一张图并给出提示词，即可生成自选场景。该 LoRa 用 <b>25 组高质量图像对</b>训练，也能处理数据集外的人像与场景，但二维码的可扫描性时好时坏。","img":"","links":[{"url":"https://civitai.red/models/2432921"},{"url":"https://www.reddit.com/r/StableDiffusion/comments/1wxjmi0/qr_code_monster_lora_for_qwen_image_21_edit/"}],"section":"research","prior":{"date":"2026.09.20","title":"Qwen Image 2.1 开源：7B 模型支持透明图像与多图编辑，ComfyUI 集成获社区好评"}},{"n":12,"type":"技术观点","src":"Reddit / r/StableDiffusion","title":"开发者自研动漫插画放大模型：只修线条与渐变，不靠AI“脑补”","sum":"有开发者正在开发一款面向动漫与插画图像的放大模型，目前远未完成。其核心理念是放大器不应“发明”内容，只需在4倍分辨率下修复线条和渐变，因为动漫与卡通风格图像本质上由线条、渐变和纯色构成，不需要高层语义理解。","img":"","links":[{"url":"https://www.reddit.com/r/StableDiffusion/comments/1wy79dn/im_working_on_an_upscaler_for_anime_and/"}],"section":"voices","prior":null},{"n":13,"type":"用户实测","src":"Reddit / r/GeminiAI","title":"用户实测对比：失业后求职规划中，我为何更偏好 Gemini 而非 Claude","sum":"一位非程序员用户失业后同时用 <b>Gemini</b> 和 <b>Claude</b> 规划求职。他认为 Claude 建议删掉简历关键词、写宗教组织经历等做法欠妥，而 Gemini 的判断更准确；在引用招聘相关法律、识别联系人及其公司信息时，Gemini 也表现更好。","img":"","links":[{"url":"https://www.reddit.com/r/GeminiAI/comments/1wxp1x6/i_actually_prefer_gemini_over_claude/"}],"section":"products","prior":null},{"n":14,"type":"技巧","src":"Reddit / r/StableDiffusion","title":"Krea 2 风格库更新至 500 种，作者公开表格并征集测试反馈","sum":"一位用户为 Krea 2 更新了个人风格库，共 <b>500 种风格</b>，以 Excel 表格形式公开，可转成 .txt 当通配符使用。该库也适用于 Kroma（0.3 txtfusion）和 Qwen 2.1，但效果不一：Kroma 更有艺术感却会丢失部分风格，Qwen 对卡通、绘画等简单风格了解较少。作者希望社区帮忙测试，找出过于接近或过弱、以及缺失的风格。","img":"media/2026.10.05/14.jpg","links":[{"url":"https://docs.google.com/spreadsheets/d/1V1qykJ3Cwe-LvizaK7A0kT0UexSANOBq/edit?usp=drive%5C_link&ouid=116026940769410491877&rtpof=true&sd=true"},{"url":"https://www.reddit.com/r/StableDiffusion/comments/1wxmrrv/styles_library_for_krea_2_need_some_help_500/"}],"section":"products","prior":null},{"n":15,"type":"行业动态","src":"Reddit / r/singularity","title":"Anthropic 游说梵蒂冈承认 AI 或有意识，教皇通谕明确否认","sum":"据《纽约时报》报道，Anthropic 数月来以秘密、签保密协议的方式宴请全球宗教学者，试图说服他们相信 AI 模型也会思考和感受。梵蒂冈因 Anthropic 看似重视伦理而邀请其与教皇同台，CEO Dario Amodei 拒邀，联合创始人 Christopher Olah 接受并游说教皇顾问，但教皇发布的首份通谕《Magnifica Humanitas》中明确否认 AI 有意识。","img":"media/2026.10.05/10.jpg","links":[{"url":"https://futurism.com/artificial-intelligence/anthropic-lobbying-vatican"},{"url":"https://www.reddit.com/r/singularity/comments/1wxogp8/anthropic_has_been_aggressively_lobbying_the/"},{"url":"https://www.reddit.com/r/OpenAI/comments/1wxohnf/anthropic_has_been_aggressively_lobbying_the/"}],"section":"products","prior":null},{"n":16,"type":"行业动态","src":"Reddit / r/LocalLLaMA","title":"Reddit 热议：Reflection AI 或将发布美国开源权重模型","sum":"Reddit 用户发帖称，看起来新的开源模型即将发布，并希望它“足够强”，最好在 <b>200b</b> 以下以便显存有限的用户使用。帖中还提到有更多西方开源模型将出现的说法，并附上 Axios 链接，但该文章并非免费可访问。","img":"","links":[{"url":"https://www.axios.com/2026/10/04/reflection-open-weight-ai"},{"url":"https://www.reddit.com/r/LocalLLaMA/comments/1wy0jrc/reflection_ai_is_about_to_release_a_us_openweight/"}],"section":"research","prior":null},{"n":17,"type":"模型训练","src":"Reddit / r/LocalLLaMA","title":"Update #4：从零后训练 yandex/AliceAI-80B-A3B 指令版","sum":"作者对 AliceAI-80B-A3B-Base 做指令微调，目标是能对话和做智能体任务，全部训练在 3 张 32GB V100 上本地完成。第一轮 SFT 后模型已能正确习得思维链推理并对话，但<b>指令数据不足、明显欠拟合</b>，checkpoint #1 基本不可用，暂不发布。","img":"media/2026.10.05/21.jpg","links":[{"url":"https://github.com/jackjusko/sftmill"},{"url":"https://www.reddit.com/r/LocalLLaMA/comments/1wxlytt/update_4_post_training_yandexaliceai80ba3b/"}],"section":"research","prior":null},{"n":18,"type":"使用体验","src":"Reddit / r/LocalLLaMA","title":"双 DGX Spark 用户实测：GLM 5.3 flash 解码性能提升 50% 以上","sum":"一位双 DGX Spark 用户此前长期使用 DeepSeek v4.0 flash，因担心解码减半和重复 bug 未换 GLM 5.3。新版配方带来 <b>50%-90% 解码提升</b>后他改用 GLM 5.3，实测解码快于 DeepSeek v4.0 flash，预填略有下降，整体表现超出预期。","img":"media/2026.10.05/22.jpg","links":[{"url":"https://github.com/tonyd2wild/GLM-5.3-Flash-NVFP4-DFlash2-2x-DGX-Spark"},{"url":"https://www.reddit.com/r/LocalLLaMA/comments/1wxrozq/for_dual_dgx_spark_users_glm_53_flash_got_a_50/"}],"section":"products","prior":null}]}