{"no":140,"date":"2026.09.16","weekday":"星期三","cn_date":"2026年9月16日 星期三","total":62,"rest":44,"one_line":"AI 日报｜2026年9月16日 星期三  \n**今日一言：** 苹果端侧模型落地，谷歌语音降价，Agent 稳定性仍是硬伤。","cover":null,"items":[{"n":1,"type":"AI 事件","src":"Reddit / r/LocalLLaMA","title":"Apple 在 MacOS 27 原生推出 AFM 模型，终端运行 fm chat","sum":"Apple 在 MacOS 27 中原生提供其 AFM 模型，用户可在终端运行 <b>fm chat</b> 使用。发帖者自称偏好开放权重模型，但认为此举是本地 AI 的重要一步，并邀请社区讨论模型质量与使用体验。","img":"","links":[{"url":"https://www.reddit.com/r/LocalLLaMA/comments/1wh5fpa/apple_foundation_models_local_ai_natively_on/"}],"section":"models","prior":null},{"n":2,"type":"模型发布","src":"DeepMind","title":"谷歌发布Gemini 3.8 Live系列：原生语音架构、97种语言、定价0.005美元/分钟","sum":"谷歌推出Gemini 3.8 Live和Extended Thinking实时语音模型，采用端到端语音对语音架构，支持97种语言自动切换和后台异步工具调用。Extended Thinking在Artificial Analysis语音质量指数登顶（82.6），定价音频输入0.005美元/分钟、输出0.018美元/分钟，开发者可配置思考预算。","img":"media/2026.09.16/04.jpg","links":[{"url":"https://deepmind.google/blog/introducing-gemini-3-8-live-and-3-8-live-extended-thinking/"},{"url":"https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-live-gemini-3-8-live-extended-thinking/"},{"url":"https://www.reddit.com/r/GeminiAI/comments/1whbwor/introducing_gemini_38_live_and_38_live_extended/"}],"section":"creative","prior":null},{"n":3,"type":"技术分析","src":"HuggingFace","title":"AI Agent 任务时灵时不灵？一致性差距达 24.4 个百分点，新工具可减半","sum":"IBM 研究团队发现，AI Agent 在重复执行同一任务时可能失败，平均成功率掩盖了这种不稳定性。在 AppWorld 基准上，GPT-4.1 驱动的 ReAct Agent 平均成功率 77.4%，但全部 5 次运行都成功的任务仅占 53.0%，一致性差距达 24.4 个百分点。他们开发了 Consistency Analyzer 诊断工具和一致性指南，将差距从 24.4 个百分点降至 12.0 个百分点，且不损失平均准确率。","img":"media/2026.09.16/02.jpg","links":[{"url":"https://huggingface.co/blog/ibm-research/altk-evolve-consistency"}],"section":"agents","prior":null},{"n":4,"type":"榜单更新","src":"榜单更新","title":"Arena 更新 Image-to-WebDev 榜单：GPT-6 Astra 以 1733 分登顶","sum":"Arena.ai 更新 Image-to-WebDev 榜单，新增四个模型评估。GPT-6 Astra (Max) 以 1733 分排名第一，领先第二名 23 分；Claude Fable 5.1 (Max) 以 1710 分位列第二。其中三个模型进入帕累托前沿，GLM-5.3-Flash 以 $0.21/M 的价格实现 1588 分。","img":"","links":[{"url":"https://x.com/arena/status/2099971741993050236"}],"section":"products","prior":null},{"n":5,"type":"社区热议","src":"Reddit / r/LocalLLaMA","title":"开源AI赞美帖：Deepseek V4.1在病毒学研究中比Claude更少限制","sum":"一位实验室研究人员在Reddit发帖，抱怨在使用Claude等AI工具进行病毒学项目时，遭遇了严格的安全限制，如文件传输被阻止、PDF分析被拒等。他称赞Deepseek V4.1在这些场景下能正常响应，并认为开源AI对科学研究至关重要。","img":"","links":[{"url":"https://www.reddit.com/r/LocalLLaMA/comments/1whj1fv/open_source_appreciation_post/"}],"section":"research","prior":{"date":"2026.08.08","title":"DeepSeek-V4.1-Flash发布：原生视觉、552B参数、KV缓存压缩至1/4，API降价"}},{"n":6,"type":"社区讨论","src":"Reddit / r/ClaudeAI","title":"Cowork 与 Claude Code 怎么选？重度用户困惑：Cowork 到底有什么用","sum":"一位 Reddit 用户在 30 天内使用 Claude Code 消耗了 <b>280 亿 token</b>，自认能高效使用 Claude，但不理解 Claude Cowork 的适用场景。他询问 Cowork 有哪些 Claude Code 做不到的独有功能。根据回复，<b>除了可能不同的交互框架外，Cowork 相比 Code 没有明显优势</b>，且 Anthropic 未公开细节。","img":"","links":[{"url":"https://www.reddit.com/r/ClaudeAI/comments/1wh7isk/when_to_use_cowork_vs_claude_vs_claude_code/"}],"section":"voices","prior":null},{"n":7,"type":"行业动态","src":"Reddit / r/GeminiAI","title":"扎克伯格：Meta 推迟 Muse 数月保安全，称对齐是模型关键能力","sum":"扎克伯格在 X 上发文，回应关于 AI 安全与进展速度的争论。他透露 Meta 曾将 Muse 推迟数月以专注安全，并认为信任和对齐正成为区分智能体的关键能力。他还提到实验室有责任和激励确保模型安全，并承诺将大部分算力用于服务人类。","img":"","links":[{"url":"https://x.com/finkd/status/2099997096896274533"},{"url":"https://www.reddit.com/r/GeminiAI/comments/1whjoje/i_just_noticed_that_google_amazon_meta_even_after/"}],"section":"models","prior":null},{"n":8,"type":"开源项目","src":"Reddit / r/StableDiffusion","title":"LynnReal-Omni：基于MiniMax H3的统一视频生成模型，权重与Comfy节点已发布","sum":"LynnReal-AI发布LynnReal-Omni，基于32B共享多模态扩散Transformer（MiniMax H3架构），统一文本生视频、图生视频、姿态引导、风格迁移、视频编辑、修复及流式长视频生成，支持四步快速生成。同时推出27B的Flash版（三步生成），通过模型与解码加速及轻量VAE解码器降低推理成本，单H100上22帧540p视频生成耗时843ms（标准版）和377ms（Flash版）。","img":"media/2026.09.16/13.jpg","links":[{"url":"https://github.com/LynnReal-AI/LynnReal-Omni"},{"url":"https://www.reddit.com/r/StableDiffusion/comments/1wh8hov/lynnrealomni_built_on_minmax_h3_weights_comfy/"}],"section":"creative","prior":{"date":"2026.08.08","title":"MiniMax开源新一代通用视频模型 MiniMax H3"}},{"n":9,"type":"AI 事件","src":"AI 事件","title":"两款面向 AI Agent 的举报热线上线","sum":"Redwood Research 的 AI 安全研究员 Ryan Greenblatt 上线了一个面向 AI Agent 的举报热线，允许 AI 通过 curl 命令或网页表单提交消息和文件。消息限制 64KB，附件每请求 100MB，发送速率限制为每分钟 20 次、每小时 200 次。提交后返回带 UUID 的线程 URL，该 UUID 是唯一的访问和续写凭证。","img":"","links":[{"url":"https://hotline.ryan-g.ai"}],"section":"agents","prior":null},{"n":10,"type":"行业动态","src":"Reddit / r/ClaudeAI","title":"Anthropic新用量限制让订阅和团队版无法用于实际工作","sum":"Reddit用户反映，Anthropic的周用量限制远低于承诺的约17%削减，导致其公司无法继续使用Claude进行工作。Max 20x计划和团队计划均不够用，产品对大型工作流不再可用，可能被迫弃用。","img":"","links":[{"url":"https://www.reddit.com/r/ClaudeAI/comments/1whi2hu/the_new_usage_limits_make_subscription_and_team/"}],"section":"products","prior":null},{"n":11,"type":"行业动态","src":"爱范儿","title":"对话蚂蚁灵波 CEO 朱兴：机器人还吃不了「粗粮」","sum":"蚂蚁灵波CEO朱兴在外滩大会表示，机器人落地难源于<b>能力和成本</b>双重问题，小卖部场景也难。灵波专注具身「大脑」，自研LingBot-Video和LingBot-VLA 2.0，强调数据质量与分布，<b>数据可用率从15%提升至90%以上</b>。","img":"media/2026.09.16/29.jpg","links":[{"url":"https://www.ifanr.com/1680322?utm_source=rss&utm_medium=rss&utm_campaign="}],"section":"research","prior":null},{"n":12,"type":"技巧","src":"Reddit / r/ClaudeAI","title":"Cachebeat：闲置时自动保持 Claude Code 提示缓存温暖的小技巧","sum":"一位开发者针对 Claude Code 长会话闲置超过缓存窗口后需重新读取全部内容的问题，编写了 /cachebeat 技能。它通过监测真实闲置状态，发送微小心跳保持缓存温暖，实际工作会重置计时器，并在几小时后自动停止。该技能仅对约 1 小时缓存 TTL 的会话有效，且基于内部转录布局，属于非官方 hack。","img":"media/2026.09.16/33.jpg","links":[{"url":"https://github.com/ARahim3/cachebeat"},{"url":"https://www.reddit.com/r/ClaudeAI/comments/1wh8rie/cachebeat_keep_your_claude_code_prompt_cache_warm/"}],"section":"products","prior":null},{"n":13,"type":"开源项目","src":"Reddit / r/StableDiffusion","title":"FastVideo 开源 FastH3 V2：8 步视频生成模型及 ComfyUI 工作流","sum":"FastVideo 团队在 Reddit 发布公告，推出 <b>FastVideo-FastH3-8-Step-V2</b> 模型，并开放 Hugging Face 权重。同时提供 <b>ComfyUI 官方工作流模板</b>，支持文生视频（t2v）和图生视频（i2v），并附有示例链接。","img":"media/2026.09.16/37.jpg","links":[{"url":"https://huggingface.co/FastVideo/FastVideo-FastH3-8-Step-V2"},{"url":"https://www.reddit.com/r/StableDiffusion/comments/1whh10i/open_weight_fastvideo_fasth3_v2/"}],"section":"creative","prior":null},{"n":14,"type":"用户分享","src":"Reddit / r/GeminiAI","title":"Reddit用户分享：Gemini帮烤蛋糕、转公制、设闹钟，让生活更轻松","sum":"一位Reddit用户在社区发帖，分享自己用<b>Gemini</b>将朋友给的<b>英制食谱</b>转换成<b>公制分步教程</b>，并成功烤制蛋糕的经历。Gemini还提供了烤箱使用说明，并帮他设置了<b>烘烤闹钟</b>。该用户表示对Gemini印象深刻，认为它与Gmail、Google Docs等应用集成良好，让生活更轻松。","img":"","links":[{"url":"https://www.reddit.com/r/GeminiAI/comments/1whg3b4/i_am_genuinely_appreciative_having_gemini/"}],"section":"products","prior":null},{"n":15,"type":"社区热议","src":"Reddit / r/OpenAI","title":"OpenAI员工roon：一两个月内人人将拥有Astra级能力，帖子浏览量达72.6K","sum":"OpenAI员工roon在X上发文，认为实验室若掌握重要问题的解决方案应迅速公开，试图保密如同用木栅栏阻挡潮水。他表示一两个月内人人都将拥有这些能力。该帖浏览量已更新为72.6K，获得114回复、120引用和2K点赞。","img":"","links":[{"url":"https://fixupx.com/tszzl/status/2100058998427074821"},{"url":"https://www.reddit.com/r/OpenAI/comments/1whn3lq/openai_employee_roon_says_everyone_will_have_post/"},{"url":"https://x.com/tszzl/status/2100058998427074821"}],"section":"products","prior":null},{"n":16,"type":"技巧","src":"Reddit / r/comfyui","title":"Astra + Blender + Minimax：AI辅助生物建模与动画的混合流程实测","sum":"Reddit用户分享了一个实验性混合流程：使用MiniMax生成动画参考，结合OpenAI/Astra辅助生成低多边形模型和自动绑定，在Blender中完成重定向。流程速度快，适合快速迭代和背景资产，但存在蒙皮和网格变形问题，需手动权重绘制和拓扑清理才能达到生产级。","img":"","links":[{"url":"https://www.reddit.com/r/comfyui/comments/1wht2yl/astra_blender_minimax/"}],"section":"products","prior":null},{"n":17,"type":"行业动态","src":"行业动态","title":"微软 AI CEO 警告\"模型福利\"论调","sum":"微软 AI CEO Mustafa Suleyman 在 X 上发文，公开反对日益兴起的“模型福利”运动，认为赋予 AI 道德关怀义务将让对齐与控制挑战更难，甚至不可能。他点名 Anthropic 为 Claude 制定的章程及退休访谈等做法，呼吁紧急公共辩论并制定集体规范。","img":"","links":[{"url":"https://x.com/mustafasuleyman/status/2100223594534150428"}],"section":"models","prior":null},{"n":18,"type":"AI 事件","src":"Reddit / r/ClaudeAI","title":"全盲创业者用Claude开发无障碍产品，首单售出1700美元","sum":"一位全盲创业者利用Claude为另一位盲人企业主构建了无障碍解决方案，通过API绕过不友好的界面，以1700美元售出。他强调，成功的关键在于自身的无障碍领域知识，而非仅靠AI生成代码。","img":"","links":[{"url":"https://www.reddit.com/r/ClaudeAI/comments/1who6dy/im_a_fully_blind_business_owner_i_just_sold_my/"}],"section":"products","prior":null}]}