{"no":22,"date":"2026.08.28","weekday":"星期五","cn_date":"2026年8月28日 星期五","total":15,"rest":0,"one_line":"开源与诉讼并至，本地推理根基再稳，自主代理亦在逼近；技术前行的阴影里，合规与伦理的边界需同步丈量。","cover":null,"items":[{"n":1,"type":"开源项目","src":"开源项目","title":"AI 工程师笔记本：在 Colab 上免费、无需框架即可使用 RAG/智能体/评估工具","sum":"该项目提供一套免费、无框架的 Colab 笔记本，覆盖从模型 API、RAG、评估到智能体的完整技能栈。所有内容可在免费 Groq API 上运行，无需信用卡，并包含三个真实案例研究。强调先测量后调优，评估作为主线贯穿始终。","img":"media/2026.08.28/40.jpg","links":[{"url":"https://github.com/calmrocks/ai-engineer-notebooks"}],"section":"agents","prior":null},{"n":2,"type":"新基准","src":"新基准","title":"Terminal-Bench-Science 0.1：评估科研工作流中的 AI 智能体","sum":"斯坦福大学研究人员领导的团队发布 Terminal-Bench-Science 0.1，这是一个由科学家而非模型开发者设定标准的科研 AI 基准。首批包含 70 个来自生命、物理、地球、数学和工程科学的专家精选任务，评估 AI 智能体在真实科研工作流中的能力。目前最强模型 Claude Opus 5 的解决率仅为 <b>30%</b>。","img":"media/2026.08.28/39.jpg","links":[{"url":"https://www.terminal-bench-science.ai/announcement"}],"section":"agents","prior":null},{"n":3,"type":"AI 事件","src":"AI 事件","title":"诉讼指控 xAI 使用儿童性虐待材料训练 Grok 模型","sum":"原告 Jane Doe 起诉 xAI，称其童年被虐待制作的 CSAM 图像被用于训练 Grok 模型，且 Grok 生成的 AI 图像也被用于再训练。她要求销毁所有 Grok 生成的 CSAM 并阻止未来生成。这是首起指控 xAI 使用 CSAM 训练的案件。","img":"media/2026.08.28/23.jpg","links":[{"url":"https://arstechnica.com/tech-policy/2026/08/elon-musks-xai-used-child-porn-to-train-grok-models-lawsuit-says"}],"section":"governance","prior":null},{"n":4,"type":"行业动态","src":"Reddit / r/LocalLLaMA","title":"HuggingFace 收购 GGML 与 llama.cpp 团队，确保本地 AI 长期发展","sum":"HuggingFace 宣布 GGML（llama.cpp 的创建者）团队加入，Georgi Gerganov 及其团队将全职维护 llama.cpp，并保持技术方向自主。项目继续 100% 开源，HuggingFace 提供长期可持续资源，并计划与 transformers 库无缝集成，改善打包和用户体验。","img":"media/2026.08.28/21.jpg","links":[{"url":"https://huggingface.co/blog/ggml-joins-hf"},{"url":"https://www.reddit.com/r/LocalLLaMA/comments/1w01y1f/with_huggingface_nvidia_is_also_acquiring/"}],"section":"products","prior":null},{"n":5,"type":"产品动态","src":"Reddit / r/OpenAI","title":"OpenAI 开发“持久模式”AI 代理，可自主持续工作","sum":"OpenAI 正在为其旗舰 AI 代理 Codex 开发“持久模式”，该模式允许代理持续工作直至被用户暂停，并具备主动创建后续任务的能力。OpenAI 发言人确认正在测试该功能，但暂无发布计划。此举旨在推动 AI 代理从被动问答转向主动服务，但持久化也带来对齐风险。","img":"media/2026.08.28/35.jpg","links":[{"url":"https://www.wired.com/story/openai-is-developing-a-persistent-ai-agent/"},{"url":"https://www.reddit.com/r/OpenAI/comments/1vzziti/openai_is_developing_a_persistent_ai_agent/"}],"section":"products","prior":null},{"n":6,"type":"融资动态","src":"量子位","title":"基元律动累计融资数千万美元，推出“中国版OpenRouter”","sum":"AI基础设施公司基元律动宣布完成新一轮数千万美元融资，由弘晖基金领投。同时，其TokenRhythm API平台启动公测，定位为中国市场的一站式多模型API服务，兼容OpenAI和Claude协议，已积累<b>5.4万</b>用户，单日Token调用量超<b>5000亿</b>。公司还押注Routing Harness基础设施，并推出开源Agent产品OpenSquilla。","img":"media/2026.08.28/02.jpg","links":[{"url":"https://www.qbitai.com/2026/08/480079.html"}],"section":"products","prior":null},{"n":7,"type":"产品发布","src":"量子位","title":"工业Agent不是“套壳”大模型！西门子百年经验灌进工业AI","sum":"西门子推出面向工业自动化工程的AI智能体Eigen，可独立完成端到端任务，执行效率提升2至5倍，工程效率提升50%。同时发布工业AI编排软件ICX，作为AI调度总台，连接企业现有系统。西门子Xcelerator平台已汇集900余款产品，超60万注册用户，600余家生态伙伴。","img":"media/2026.08.28/03.jpg","links":[{"url":"https://www.qbitai.com/2026/08/480005.html"}],"section":"agents","prior":null},{"n":8,"type":"AI事件","src":"AI事件","title":"央视曝光 AI 相亲骗局：虚假婚介专盯中老年女性，28 人落网","sum":"央视报道，四川成都警方打掉一个“AI相亲”诈骗团伙，抓获王某等28人，涉案金额超百万元，约50余名群众受损。该团伙用AI生成男性形象直播，配合变声器和话术剧本，虚构人设骗取服务费，绝不提供真实相亲。","img":"","links":[{"url":"https://news.aibase.com/zh/news/30678"}],"section":"products","prior":null},{"n":9,"type":"行业动态","src":"行业动态","title":"亚马逊订单激增三倍，英伟达芯片成全球大厂“硬通货”","sum":"亚马逊与英伟达深化合作，在已部署超100万枚GPU基础上，再引入200万枚英伟达GPU芯片，涵盖Blackwell Ultra、Rubin等架构，预计2027-2028年部署至AWS数据中心。英伟达全栈技术生态将整合进AWS，同时亚马逊自研芯片业务年收入运行率已突破250亿美元。","img":"","links":[{"url":"https://news.aibase.com/zh/news/30671"}],"section":"products","prior":null},{"n":10,"type":"新模型","src":"新模型","title":"千问办公首发上线Qwen3.8-Flash，Agent正式迈入“量大管饱”时代","sum":"千问办公平台首发上线Qwen3.8-Flash大模型，并推出全新标准模式，全体用户可直接体验。该模型采用千亿级总参数，官方测试表现超越Claude Opus4.6，并针对Agent核心场景专项调优。实测数据显示，标准模式单任务生成速度提升约100%，Token消耗平均下降75%。","img":"media/2026.08.28/11.jpg","links":[{"url":"https://news.aibase.com/zh/news/30668"}],"section":"agents","prior":null},{"n":11,"type":"新模型","src":"爱范儿","title":"机器人运动会散场后，自变量给机器人建了一座「虚拟训练场」","sum":"自变量机器人发布自回归世界模型WALL-SS，构建虚拟训练场，可推演持续60秒的倒水和物品整理任务。在600对虚拟与真机对比实验中，527对最终成败一致，虚拟与真机成功率相关系数为0.926。","img":"media/2026.08.28/04.jpg","links":[{"url":"https://www.ifanr.com/1677048?utm_source=rss&utm_medium=rss&utm_campaign="}],"section":"research","prior":null},{"n":12,"type":"行业动态","src":"爱范儿","title":"OpenAI 的中场战事","sum":"OpenAI 在《时代》采访中承认产品方向失误，落后于 Anthropic 和 Google。公司已收缩 Sora 等项目，将资源集中于 Codex，并计划用下一代模型 Astra 实现持续工作的 Agent 能力。因安全事件，Astra 训练暂停，发布时间待定。","img":"media/2026.08.28/07.jpg","links":[{"url":"https://www.ifanr.com/1676929?utm_source=rss&utm_medium=rss&utm_campaign="}],"section":"products","prior":null},{"n":13,"type":"行业动态","src":"DeepMind","title":"DeepMind 推出全球首个双盲 AI 评估，防止模型作弊","sum":"DeepMind 联合新加坡 AI 安全研究所、OpenMined、AVERI 和 MLCommons，对 Gemini Flash Lite 模型进行全球首个双盲评估。通过 Google Cloud 机密计算，外部评估数据与模型权重均保持私密，防止基准污染，提升评估完整性。","img":"media/2026.08.28/09.jpg","links":[{"url":"https://deepmind.google/blog/piloting-the-worlds-first-double-blind-ai-evaluations/"}],"section":"models","prior":null},{"n":14,"type":"功能更新","src":"功能更新","title":"ChatGPT临时聊天更新：可调用记忆与插件，支持转为常规聊天","sum":"ChatGPT 更新临时聊天功能，用户可选择个性化响应，使用记忆、插件和自定义指令，但不会创建新记忆。临时聊天可保存并转换为常规聊天，之后遵循账户级个性化设置。默认临时聊天不个性化，且个性化设置仅在开始时设定。","img":"media/2026.08.28/25.jpg","links":[{"url":"https://help.openai.com/en/articles/6825453-chatgpt-release-notes"}],"section":"products","prior":null},{"n":15,"type":"研究预览","src":"研究预览","title":"Anthropic 推出 Model Hardware Standard 研究预览版","sum":"Anthropic 与 HHMI Janelia 研究园区合作，推出 Model Hardware Standard（MHS）研究预览版，面向科研实验室和先进制造商。MHS 通过标准化驱动，将设备集成时间从数周缩短至数小时或数分钟，并支持 AI 代理并行操控显微镜、液体处理器和机械臂等设备，执行药物发现实验或量子计算机激光校准等任务。","img":"media/2026.08.28/27.jpg","links":[{"url":"https://www.anthropic.com/news/model-hardware-standard-research-preview"}],"section":"research","prior":null}]}