OpenAI:Improving GPT‑5.6 Sol in ChatGPT—and expanding access to GPT-5.6 Luna for free users
AI SummaryOpenAI 发布改进版 GPT-5.6 Sol,提升准确性和一致性,同时向免费用户扩大 GPT-5.6 Luna 的访问权限,并开放无限日常对话。
解读产品迭代与免费策略并行,重点在提升体验和扩大触达,而非单纯能力跃迁。
EDITORIAL BRIEF
今天筛出 14 个事件:大厂动态 5 条,技术进展 3 条,行业观点 6 条;另读 Hugging Face Papers 5 篇。
AI 公司动态 · 模型发布 · 新业务 · 融资投资 · 人员变动
AI SummaryOpenAI 发布改进版 GPT-5.6 Sol,提升准确性和一致性,同时向免费用户扩大 GPT-5.6 Luna 的访问权限,并开放无限日常对话。
解读产品迭代与免费策略并行,重点在提升体验和扩大触达,而非单纯能力跃迁。

AI Summary钛媒体晨报报道,DeepSeek拟整体上调API服务定价,涨幅较大;同时DeepSeek作为战略投资者获配宇树科技IPO股份。
解读提价是商业化信号,投资宇树是生态卡位,DeepSeek正从模型供应商向平台型公司演进。

AI SummaryAnthropic与Millennium合作开发数字风险分析师,基于Claude和Claude Code,由人类风险经理监督,用于跨资产类别的风险洞察与风险敞口分析。
解读本质是Anthropic将Claude嵌入金融风控场景,强调人类监督,属于企业级AI代理落地案例,验证AI在受监管行业的可行性。

AI SummaryAdobe推出ChatGPT插件,整合70余款创意与生产力工具,可在ChatGPT的Work和Codex中使用,今日上线。
解读Adobe借插件将专业工具嵌入ChatGPT,既扩展分发渠道,也应对AI设计工具竞争,是传统软件与AI助手融合的典型动作。

AI Summary8月6日,阿里旗下企业级Agent产品“千问办公”推出鸿蒙电脑版,用户可在华为应用市场下载,现已支持Windows、macOS和HarmonyOS三大系统。
解读这是千问办公公测后的渠道扩展,核心是覆盖鸿蒙生态,而非模型能力更新。
Hugging Face · 技术报告 · 论文 · Benchmark · RL 研究
逐篇读取当天 paper 页面,由 deepseek-v4-flash-ga-260731 生成中文摘要。
AI Summary提出ABC框架,将稀疏轨迹结果转为密集步骤级奖励,区分有效与错误动作,训练出4B规模的搜索智能体ABSeeker。
AI Summary提出完全智能体化的图像生成模型,通过后训练统一多模态模型,让推理、工具调用和图像生成由单一策略协调。
AI Summary提出OneDayAgent,将开放式长时程请求分解为有界子任务,维护执行记忆并验证修复最终交付物,在AgentIF-OneDay上取得0.821分。

AI SummaryArtificial Analysis公布新一期榜单,阿里Qwen3.8-Max在Agentic能力得分55.4分,超越Claude Opus5和GPT5.6,位列全球第一。
解读单一榜单登顶不等于真实Agent能力领先,且此文为阿里供稿,需独立验证评测口径。

AI Summary中国信通院公布办公智能体能力评估结果,阿里千问办公成为国内首个通过评估的办公Agent产品,在16项测试中达标,覆盖任务执行、数据安全、风险管理等能力。
解读信通院自定标准下的首个认证,更多是合规背书而非能力排名,需看后续厂商跟进与真实场景表现。

AI SummaryAWS 在 SageMaker Python SDK v3 中新增生成式 AI 推理推荐功能,支持在 notebook 内直接对端点进行基准测试、生成部署建议并部署最优配置,无需离开工作流。
解读把推理优化从 Studio/Boto3 下沉到 SDK,降低调优门槛,但本质仍是 AWS 平台能力增强,非模型或算法突破。
X 大 V · YouTube / Podcast · Builder 观察 · 开发者讨论
解读这是工程实践观察,非正式产品。线程回调模式降低多代理协调成本,但缺乏UI和状态管理,仍是hack级别方案。
解读个人推荐帖,暗示Codex的/goal与GPT-5.6 Sol组合强大,但无具体细节,需官方确认。