01大模型2026.09.03闭源 · 托管服务GPT-6 Astra能力提升之后,如何评估智能体的行为OpenAI 随 Astra 发布系统卡,披露模型能力、安全评测、对齐与可监测性结果。OpenAI智能体安全评测阅读简报
02大模型2026.09.01闭源 · 分级访问Claude Fable / Mythos 5.1同一底座,不同访问与防护边界Fable 5.1 面向一般使用,Mythos 5.1 通过可信访问计划提供;官方强调编程、知识工作与科研能力。Anthropic编程科研阅读简报
03大模型2026.08.12开放权重 · 专用许可Qwen3.8旗舰能力走向开放权重Qwen3.8 发布 2.4T-A95B 与 27B 模型,重点推进编程、专业任务和长程智能体执行。Qwen · 阿里巴巴智能体开放权重阅读简报
04大模型2026.07.17开放权重 · 专用许可Kimi K3原生视觉与百万级上下文的开放模型2.8 万亿参数的原生多模态模型,采用 KDA 与 Attention Residuals,面向长程编程和知识工作。Moonshot AI长上下文多模态阅读简报
DADario AmodeiAnthropic 联合创始人2026 年 9 月 · 原文仅标月份观点转述为安全评估留出追赶能力的时间Amodei 主张控制前沿能力增长节奏,并提出常驻第三方评估、行业协调与全球协调三个层次。这是作者的政策主张与风险判断,不是对未来的确定预测。作者原文
DHDemis HassabisGoogle DeepMind 联合创始人2026.07.14观点转述为前沿 AI 建立动态、严格的评估机制Hassabis 在署名文章中讨论 AGI 的潜在收益与风险,提出建立前沿 AI 标准机构的框架。对 AGI 时间与影响的判断属于作者观点;文章并不证明这些预测必然实现。作者署名文章