2026.09.23 AI 日报
阅读知一刻 2026.09.23 AI 日报,查看当日精选事件、完整解读与原始来源。
2026年9月23日 星期三 · 当日 58 件事 · 精选 18 条深读
今日一言
价格战开启而智能持平,开源图像模型登顶设计榜,AI 内容渗透引发信任追问。
GPT-6 Sol 与 Luna 发布,API 价格比 GPT-5.6 低 50%
OpenAI发布GPT-6 Sol和Luna,API价格较GPT-5.6促销价降低50%,Luna定价每百万Token输入0.1美元、输出0.5美元,已低于DeepSeek V4.1 Flash的普通请求价格。Sol在AutomationBench得分33.2%,成本仅为Opus 5的9%;在DeepSWE v1.1得分68.8%,接近Claude Fable 5。模型已向Plus、Pro等用户开放,免费用户可用Luna。
产品发布 · 爱范儿
原始来源 ↗ 原始来源 ↗ 原始来源 ↗
蚂蚁开源 Ming-Image-0.1-Design 系列 6B 图像模型,登顶 UI/UX 设计榜
蚂蚁集团开源了 Ming-Image-0.1-Design 和 Ming-Image-0.1-Design-Layer 两个 6B 模型,并发布两个开源 Agent 技能:Ling UI Design Skill 和 Image-to-Editable-PPT Skill。该模型在 Artificial Analysis 的 UI/UX 设计排行榜上位列开源权重模型第一</b
开源项目 · Reddit / r/LocalLLaMA
原始来源 ↗ 原始来源 ↗
Agent时代,CPU的价值该重估了
英特尔在苏州技术创新大会上表示,Agent正改变AI计算配比,从一颗CPU配四颗GPU(1:4)变为1:1,CPU需承担更多调度、数据处理和执行工作。英特尔CEO陈立武称x86是现代计算基石,市场反应积极,股价暴涨12%。
行业动态 · 量子位
原始来源 ↗
Claude 回归:Opus 5.5 重拾协作体验,用户称终于找回真实 Claude
一位 Reddit 用户表示,Claude 在 Opus 4.7 之后的模型语气问题严重,但使用 Opus 5.5 数小时后,感觉 Claude 终于回归协作风格,不再偏执。用户感谢 Anthropic 解决了语气问题。
用户反馈 · Reddit / r/ClaudeAI
原始来源 ↗
GPT-6 Sol/Luna 成本减半,智能持平,评测有升有降
OpenAI 发布 GPT-6 Sol 和 Luna,价格约为 GPT-5.6 的一半,智能指数和编码智能体指数总体持平,但各评测有升有降。Sol 在编码智能体指数上提升 2 分,Luna 下降 2 分;两者在 AA-Omniscience 中幻觉率显著降低,但在 GDPval-AA v2.1 中均出现回退。
评测报告 · 评测报告
原始来源 ↗ 原始来源 ↗ 原始来源 ↗
Reddit 用户质疑:这些评论全是 AI 机器人发的吗?
一位 Reddit 用户在 r/LocalLLaMA 子版块发帖,称知道该版块存在一些机器人,但看到某些评论后惊讶于其高度疑似 AI 生成,并附上截图询问其他用户是否也有同感。
社区热议 · Reddit / r/LocalLLaMA
原始来源 ↗
OpenAI 宣布将在 AI 模型开发早期阶段引入第三方独立安全评估
OpenAI 公布最新安全治理动向,计划将第三方独立机构引入 AI 模型开发周期的更早阶段,进行系统性安全风险评估。为确保机制有效,明确了四大关键支柱:独立运作、科学严谨、稳健实践、责任清晰。此举旨在回应外界对 AI 风险的担忧。
行业动态 · 行业动态
原始来源 ↗
OpenAI 发布 GPT-6 Sol 与 Luna,API 定价降至五折并公布基准成绩
OpenAI 发布 GPT-6 Sol 和 Luna,定位低于 Astra,主打更快更便宜。API 定价较 GPT-5.6 促销价降低 50%(Luna 输出降约 58%)。在多个基准测试中,Sol 和 Luna 以更低成本达到或超越竞品表现,并改进了提示缓存系统。
新模型 · 新模型
原始来源 ↗
Opus 5.5 帮我建了个网站:照片一键变单线画,还能生成绘制过程视频
Reddit 用户分享,Opus 5.5 构建了一个网站,可将照片重绘为单线画,提供螺旋、漫游、轮廓、迷宫四种模式,以及 11 种工具和 7 种纸张。所有处理均在浏览器本地完成,支持导出 8K PNG 和 SVG,并可生成 9:16 等比例、10-60 秒的绘制过程视频。
开源项目 · Reddit / r/ClaudeAI
原始来源 ↗ 原始来源 ↗
Unreal Agent:异步工具管理降低 AI Agent 成本,最高节省 40%
Unreal Labs 推出 Unreal Agent,其 harness 以完全异步方式管理工具调用,减少模型等待和轮询开销,从而降低 token 消耗。在 Terminal-Bench 4.0 等基准测试中,相比 Codex 和 Pi,Unreal Agent 在保持相近通过率的同时,总成本降低最高 40%(对比 Codex)和 20%(对比 Pi)。
产品发布 · 产品发布
原始来源 ↗
DeepSeek与月之暗面遭北京调查:被指将用户数据路由至Anthropic
据The Information报道,中国网信办已派员前往DeepSeek和月之暗面办公室,约谈高管和员工,评估其将用户提示和数据路由至Anthropic Claude的违规严重程度。北京担心敏感军事、警务和企业信息可能泄露给美国,违反数据安全法。Anthropic报告称,这两家公司将包含敏感信息的实时客户对话通过Claude处理,并用作训练数据。
AI事件 · Reddit / r/LocalLLaMA
原始来源 ↗ 原始来源 ↗
Opus 5.5 初体验:一位训练有素哲学家的印象
一位受过哲学训练的 Reddit 用户对 Opus 5.5 进行了开放式访谈,认为该模型比前代更流畅、更健谈,能平衡跟随与批判,避免谄媚和习惯性回避,适合检验想法。
模型评测 · Reddit / r/ClaudeAI
原始来源 ↗
观点:GPT-6 Sol 定价减半,应对比 Sonnet 而非 Opus
Reddit 用户提出,GPT-6 Sol 价格降至 $2/$10,与 Terra 5.6 和 Sonnet 5 相近,且无 GPT-6 Terra 发布,因此 Sol 应对比 Sonnet 5.5 而非 Opus 5.5。作者因 Astra 出现而减少使用 Sol,但新定价使其回归日常任务。同时指出 Anthropic 的 Sonnet 定位尴尬,可能被取消。
行业动态 · Reddit / r/OpenAI
原始来源 ↗
Opus 5.5 与 GPT-6 Sol 同日发布:基准测试全面对比,Opus 全胜但成本更高
Anthropic 发布 Claude Opus 5.5,在 Artificial Analysis 智能指数中得分 58,排名第一。模型支持文本和图像输入,上下文窗口 1M tokens,输入输出价格分别为 $4.00 和 $20.00 每百万 tokens,缓存折扣 95%。评估中生成 260M tokens,总成本 $8708.20。
模型发布 · Reddit / r/OpenAI
原始来源 ↗ 原始来源 ↗
Qwen 2.1 数据集生成器:基于 ComfyUI 工作流适配,保持人物身份一致性
Reddit 用户分享了一个适配 Qwen-Image 2.1 的数据集生成工作流,基于 u/acekiube 的原始工作流修改,用于生成人脸数据集。作者推荐 CFG 3、25 步,并使用 res_multistep/simple 采样器,上传两张图片(含侧视图)效果更佳。工作流可在 Civitai 下载。
开源项目 · Reddit / r/comfyui
前情:2026.09.20 Qwen Image 2.1 开源:7B 模型支持透明图像与多图编辑,ComfyUI 集成获社区好评
原始来源 ↗ 原始来源 ↗
实测 Qwen-Image-2.1:提示词遵循度惊人,轻松生成业余手机摄影风格
Reddit 用户尝试了 Qwen-Image-2.1 模型,对其提示词遵循度表示惊叹。该用户测试了业余手机摄影风格,包括动态背景、运动模糊和低光车站噪点等效果,并分享了使用的 LoRA 链接和工作流。
新模型 · Reddit / r/StableDiffusion
原始来源 ↗ 原始来源 ↗
Luna 6 相比 5.6 大幅降级:遗漏关键细节,回答更不实用
一位开发者维护的智能体报告工具使用 Luna 模型,A/B 测试显示 Luna 6 在涉及审查报告并查找相关项目的评估中,每次都遗漏应包含的项目,而 Luna 5.6 没有遗漏。Luna 6 倾向于用最少 token 回答,给出模糊答案,需要用户多次追问,整体实用性不如 5.6。
模型评测 · Reddit / r/OpenAI
原始来源 ↗
AI成本每季度降50%,速度超DNA测序4倍、超锂电池18倍
据Reddit用户引用Epoch AI Research数据,AI智能成本以每季度50%的速度下降,比DNA测序快4倍,比计算能力快6倍,比锂电池快18倍,比电力(至1973年)快54倍。用户认为未来每年都将显著不同,并预测很快能在手机上运行编程代理。
行业动态 · Reddit / r/LocalLLaMA
原始来源 ↗ 原始来源 ↗