{"no":997,"date":"2026.09.28","weekday":"星期一","cn_date":"2026年9月28日 星期一","total":59,"rest":41,"one_line":"Qwen 去冗余词反涨准确率，英伟达铺开智能体安全平台，本地视频生成与高效推理模型继续压低门槛。","cover":null,"items":[{"n":1,"type":"技巧","src":"Reddit / r/LocalLLaMA","title":"给 Qwen 模型加 logit 惩罚抑制“wait”“maybe”等词，准确率反而提升","sum":"有网友受 Meta 一篇论文启发，在 llama.cpp 中对 <b>Qwen3.5-4B</b> 的多种量化版本施加 logit 惩罚，抑制“wait”“maybe”“perhaps”等过度思考标记词。在 50 道随机 MATH-500 题上，<b>BF16 准确率从 74% 升到 84%</b>，Q8_0、Q4_K_M、Q3_K_M、Q2_K 也均有提升，推理 token 数同时下降。","img":"","links":[{"url":"https://arxiv.org/pdf/2606.00206"},{"url":"https://www.reddit.com/r/LocalLLaMA/comments/1wromzr/adding_logit_penalty_for_wait_maybe_and_perhaps/"}],"section":"models","prior":null},{"n":2,"type":"技巧","src":"Reddit / r/StableDiffusion","title":"Reddit 网友用 RTX 5090 本地生成 180 段视频，全靠 ComfyUI 工作流","sum":"一位 Reddit 网友花一整天用 ComfyUI 多套工作流本地制作变身视频，共生成约 <b>180 段视频</b>。初始图像由 Krea2 生成，后续编辑用 Qwen 2.1 edit 模型，全部采用 i2v 首尾帧技术，最后在剪辑软件中拼接。视频用其自训练模型 <b>Skrisp Texture</b> 本地放大，硬件为 <b>RTX 5090</b>。","img":"","links":[{"url":"https://files.catbox.moe/51h3mc.mp4"},{"url":"https://www.reddit.com/r/StableDiffusion/comments/1wrzcwy/i_still_cant_believe_i_can_generate_this_all/"}],"section":"creative","prior":null},{"n":3,"type":"产品发布","src":"产品发布","title":"英伟达发布AI智能体安全平台，含实时隔离异常智能体的Sentry系统","sum":"英伟达发布<b>开放式 AI 智能体安全平台</b>，可对 AI 智能体、智能体硬件、机器人系统进行全栈治理和控制。平台包含 <b>OpenShell 安全软件</b>，可为 CPU 上运行的智能体设定边界并支持开源/闭源模型；同时推出看门狗系统 <b>NVIDIA Sentry</b>，运行在 BlueField-4 DPU 上，可在毫秒内隔离试图突破枷锁的智能体。","img":"media/2026.09.28/32.jpg","links":[{"url":"https://www.ithome.com/1/007/937.htm"}],"section":"agents","prior":null},{"n":4,"type":"产品发布","src":"产品发布","title":"英伟达联合超100家伙伴推出开放代理安全平台","sum":"英伟达联合超100家伙伴推出 NVIDIA Open Agent Safety Platform，整合 OpenShell 与 Sentry。新增来源披露：黄仁勋称其为“智能体的浏览器”，提供只允许智能体访问工作所需内容的隔离系统；英伟达称该平台本可阻止 OpenAI 的 Hugging Face 事件，当时 Hugging Face 报告超过 17,000 个智能体攻击其基础设施。","img":"media/2026.09.29/13.jpg","links":[{"url":"https://x.com/JensenHuang/status/2104499465055023424"},{"url":"https://developer.nvidia.com/blog/nvidia-open-agent-safety-platform-a-reference-for-continuous-in-silicon-agent-monitoring/"},{"url":"https://www.cnbc.com/2026/09/28/nvidia-releases.html"}],"section":"products","prior":null},{"n":5,"type":"新模型","src":"新模型","title":"Fireworks AI 发布 Ember-1：基于 Kimi K3 的后训练模型，推理 Token 减少约 40%","sum":"Fireworks AI 发布 Ember-1，这是对 Moonshot AI 开源权重模型 Kimi K3 做后训练得到的专用模型，学会在保持任务准确率的同时生成更短的推理轨迹。官方称其达到 K3 的质量但 <b>Token 用量减少约 40%</b>，目前仅通过 Fireworks 无服务器 API 以 Research Preview 形式提供，<b>未公开权重和训练代码</b>。","img":"media/2026.09.28/25.jpg","links":[{"url":"https://www.marktechpost.com/2026/09/28/fireworks-ai-releases-ember-1-a-post-trained-kimi-k3-that-uses-about-40-fewer-tokens/"}],"section":"research","prior":{"date":"2026.08.08","title":"Kimi K3 开放模型权重、技术报告和关键 Infra 技术"}},{"n":6,"type":"技巧","src":"Reddit / r/StableDiffusion","title":"Reddit 用户自制 Anima 模型完整指南：从 Forge Neo 配置到提示词与图生图","sum":"一位 Reddit 用户认为现有 Anima 指南大多质量很差，甚至因 AI 幻觉而误导他人，于是自己动手编写了一套完整指南。指南共分五部分：<b>模型介绍与竞争现状</b>、<b>UI 选项与 Forge Neo 配置及提速技巧</b>、<b>不同模式的生成参数</b>、<b>提示词写法及 AI 助手为何不擅长</b>、<b>img2img 与 inpainting 及放大经验</b>，并附有 Civitai 合集链接。","img":"","links":[{"url":"https://civitai.red/collections/17451195"},{"url":"https://www.reddit.com/r/StableDiffusion/comments/1wru8v0/all_guides_for_anima_were_underwhelming_so_i_made/"}],"section":"models","prior":{"date":"2026.09.26","title":"Reddit 用户盛赞 Anima：小巧高效的 DiT 动漫开源模型"}},{"n":7,"type":"AI 事件","src":"Reddit / r/ClaudeAI","title":"5天用Claude氛围编程做出3D卡丁车游戏Sloppy Kart","sum":"作者用5天时间通过“氛围编程”做出3D卡丁车游戏Sloppy Kart，自己不会编程，靠描述需求让Claude写代码，DeepSeek和ChatGPT在Claude额度用尽时替补。3D模型由AI生成后在Blender中修复，音乐来自Suno，游戏面向TikTok LIVE，观众可从聊天加入比赛。","img":"","links":[{"url":"https://www.reddit.com/r/ClaudeAI/comments/1wsep0x/sloppy_kart_a_totally_finished_product/"}],"section":"creative","prior":null},{"n":8,"type":"AI 事件","src":"AI 事件","title":"404 Media 报道人类审阅员正在查看 Copilot 用户提示词与上传图片","sum":"404 Media 根据内部文件报道，微软 Copilot 雇佣的<b>人类外包审阅员</b>会看到用户上传的图片和提示词，其中大量是色情化编辑请求，如缩短女性裙子、放大胸部、把真人摆成性暗示姿势。这些审阅员的任务不是过滤违规内容，而是<b>评判 Copilot 生成图像的质量</b>。","img":"media/2026.09.28/40.jpg","links":[{"url":"https://www.404media.co/humans-reading-copilot-prompts-images/"}],"section":"agents","prior":{"date":"2026.08.18","title":"404 Media 追踪珍本图书流向：亚马逊批量购书扫描用于 AI 训练后销毁"}},{"n":9,"type":"行业动态","src":"行业动态","title":"Meta 推出 Hologram 拟真虚拟形象，秋季上线雷朋眼镜与 Quest 头显","sum":"Meta 宣布今年秋季起为雷朋 Display 智能眼镜、Quest 头显及全新轻薄型头显上线 <b>Hologram</b> 拟真虚拟形象，效果类似苹果 Vision Pro 的 Persona。用户需在 Meta AI 应用中转动头部、微笑并长时间回答开放式问题，几分钟即可完成建模。眼镜端以音频驱动实时扩散模型生成 2D 视频流，Quest 端则呈现 3D 等身形象。","img":"media/2026.09.28/22.jpg","links":[{"url":"https://www.ithome.com/1/007/767.htm"}],"section":"products","prior":null},{"n":10,"type":"开源项目","src":"Reddit / r/MachineLearning","title":"MIT 许可的免费 AI 工程课：523 节手写算法，新增 EPUB/PDF 电子书","sum":"AI Engineering from Scratch 是一套 MIT 许可的课程，共 <b>523 节、20 个阶段</b>，从线性代数和反向传播讲到 Transformer、LLM、智能体和生产部署。代码以标准库优先，让学习者看到每一步而不是直接调用库。本月新增由课程生成的 <b>六卷 EPUB 和 PDF</b>，站点界面与课程支持 <b>八种语言</b>，CI 开始运行每节课自己的测试。","img":"media/2026.09.28/42.jpg","links":[{"url":"https://aiengineeringfromscratch.com"},{"url":"https://www.reddit.com/r/MachineLearning/comments/1ws6e9p/free_opensource_ai_engineering_course_where_you/"}],"section":"research","prior":null},{"n":11,"type":"行业动态","src":"Reddit / r/MachineLearning","title":"Reddit 热议：神经架构搜索、对抗 ML 等机器学习子领域是否正在变得无关紧要","sum":"Reddit 用户发帖讨论机器学习中哪些子领域正在变得无关紧要。他提到一篇综述称神经架构搜索 5 年内提出 <b>3000+</b> 个新模型，但 transformer 并非由 NAS 发现，此后 NAS 领域悄然消失；Nicholas Carlini 的幻灯片则写着对抗 ML <b>9000 篇论文毫无进展</b>。他还认为 ML 伦理、偏见与公平在 AI 灭绝风险讨论面前已不应是优先事项。","img":"","links":[{"url":"https://www.reddit.com/r/MachineLearning/comments/1wrqoxp/are_there_machine_learning_subfields_that_are/"}],"section":"products","prior":null},{"n":12,"type":"技巧","src":"Reddit / r/ClaudeAI","title":"反向提问：让AI先采访我，再帮我整理思路","sum":"一位Reddit用户分享了自己的工作方法：把提问权交给AI，让AI<b>一次问一个问题</b>，直到理解自己真正想表达什么、受众是谁。等AI问完，内容已基本口述成型，再让AI组装，产出围绕真实回答而非猜测。","img":"","links":[{"url":"https://www.reddit.com/r/ClaudeAI/comments/1wrrl96/the_best_thing_i_do_all_week_is_have_it_interview/"}],"section":"products","prior":null},{"n":13,"type":"行业动态","src":"Reddit / r/ClaudeAI","title":"Opus 5.5 是否被削弱？新基准 LiveNerf 每日追踪","sum":"有开发者自 Opus 5.5 发布首日起持续追踪其表现，每天重跑 GPQA、SWE-bench 等独立基准并记录成图。截至当前<b>未检测到模型被削弱</b>，其判定阈值为 LiveNerf 上偏差超过 <b>7.5 分</b>。作者称第 10 天可建立基线，第 20 天前不做实质判断。","img":"media/2026.09.28/16.jpg","links":[{"url":"https://github.com/ninjahawk/livenerf"},{"url":"https://www.reddit.com/r/ClaudeAI/comments/1wryrwx/is_opus_55_nerfed_new_benchmark_called_livenerf/"}],"section":"products","prior":{"date":"2026.09.23","title":"Opus 5.5 帮我建了个网站：照片一键变单线画，还能生成绘制过程视频"}},{"n":14,"type":"社区热议","src":"Reddit / r/GeminiAI","title":"Reddit 网友自称拿到 Gemini 未发布影子版本泄露宣传物料","sum":"Reddit 用户发帖自称拥有对 Gemini 能力的<b>双重秘密访问权限</b>，可接触处于能力前沿的<b>预发布影子版本</b>。该用户称这些权限来自其在推特上认识的一个人，并称对方<b>泄露了来自未来的宣传物料</b>。","img":"","links":[{"url":"https://www.reddit.com/r/GeminiAI/comments/1wrpk8w/this_latest_version_is_fire/"}],"section":"models","prior":null},{"n":15,"type":"AI 应用","src":"Reddit / r/LocalLLaMA","title":"Qwen 玩魔兽世界：自建私服与浏览器客户端，用 MCP 驱动游戏","sum":"有开发者近期做了一批 vibe coding：让 AI 代理为自己托管了一个私人 WoW 服务器，并搭建了<b>网页浏览器客户端</b>，无需安装游戏即可游玩，还带移动端操作。之后又做了自定义 <b>MCP</b> 来驱动客户端，实现对游戏更精细的控制，代理框架可接入本地或云端 LLM。","img":"","links":[{"url":"https://jankcraft.xyz/"},{"url":"https://www.reddit.com/r/LocalLLaMA/comments/1wry136/qwen_plays_world_of_warcraft/"}],"section":"agents","prior":null},{"n":16,"type":"社区热议","src":"Reddit / r/OpenAI","title":"Reddit 用户吐槽 ChatGPT App 每隔几天就改一次界面","sum":"有 Reddit 用户发帖抱怨 <b>ChatGPT App 每隔几天就调整界面</b>，功能位置、聊天展示方式等细节几乎每次更新都会变。帖主列举了 5 小时窗口消失又回归、重置提示时有时无、模型输出流式显示时好时坏等反复变动，并询问其他用户是否也有同感、该如何应对。","img":"","links":[{"url":"https://www.reddit.com/r/OpenAI/comments/1wrq35q/annoyed_of_chatgpt_app_changing_their_ui_every/"}],"section":"products","prior":null},{"n":17,"type":"行业动态","src":"Reddit / r/GeminiAI","title":"Google One 套餐页显示：AI Plus 档位不含 Pro 模型","sum":"Google One 定价页列出各档位权益：<b>Google AI Plus（2 TB）</b>每月 SGD 13.99，含 Gemini 应用双倍用量上限和 Flash Thinking 模型；<b>Google AI Pro（5 TB）</b>每月 SGD 28.99，才包含 Pro 模型与 Deep Research。页面未说明 AI Plus 此前是否提供过 Pro 模型。","img":"","links":[{"url":"https://one.google.com/plans"},{"url":"https://www.reddit.com/r/GeminiAI/comments/1wscvps/psa_google_ai_plus_will_no_longer_have_access_to/"}],"section":"models","prior":null},{"n":18,"type":"行业动态","src":"Reddit / r/OpenAI","title":"OpenAI 员工吐槽公司文化：每天项目转向、一周工作 7 天","sum":"一名自称在 OpenAI 工作的人在 Reddit 发帖吐槽公司文化，称公司<b>完全不把员工当人看</b>，每天项目转向，很多工作源于纯粹的混乱。<b>团队每周工作 7 天</b>，入职期间经历两次重组，经理频繁更换。发帖人给出 1 星评价，除非是刚毕业、无事可做、住在办公室附近且每周工作 100 小时，才会给 5 星。","img":"","links":[{"url":"https://www.reddit.com/r/OpenAI/comments/1ws7dgr/openai_culture_is_shit/"}],"section":"products","prior":null}]}