aiwillknow.AI 前沿观察每日 08:00 开始整理

2026.09.17 简报

近三个月精选 · 覆盖 2026.06.17 2026.09.17

以下为当期记录;研究详情页展示最新已核对信息。

全部收录
4 项工作
大模型闭源 · 托管服务

GPT-6 Astra

能力提升之后,如何评估智能体的行为

OpenAI 随 Astra 发布系统卡,披露模型能力、安全评测、对齐与可监测性结果。

OpenAI
智能体安全评测
阅读简报
大模型闭源 · 分级访问

Claude Fable / Mythos 5.1

同一底座,不同访问与防护边界

Fable 5.1 面向一般使用,Mythos 5.1 通过可信访问计划提供;官方强调编程、知识工作与科研能力。

Anthropic
编程科研
阅读简报
大模型开放权重 · 专用许可

Qwen3.8

旗舰能力走向开放权重

Qwen3.8 发布 2.4T-A95B 与 27B 模型,重点推进编程、专业任务和长程智能体执行。

Qwen · 阿里巴巴
智能体开放权重
阅读简报
大模型开放权重 · 专用许可

Kimi K3

原生视觉与百万级上下文的开放模型

2.8 万亿参数的原生多模态模型,采用 KDA 与 Attention Residuals,面向长程编程和知识工作。

Moonshot AI
长上下文多模态
阅读简报

人物与观点

2
Dario AmodeiAnthropic 联合创始人
2026 年 9 月 · 原文仅标月份观点转述

为安全评估留出追赶能力的时间

Amodei 主张控制前沿能力增长节奏,并提出常驻第三方评估、行业协调与全球协调三个层次。

这是作者的政策主张与风险判断,不是对未来的确定预测。

Demis HassabisGoogle DeepMind 联合创始人
2026.07.14观点转述

为前沿 AI 建立动态、严格的评估机制

Hassabis 在署名文章中讨论 AGI 的潜在收益与风险,提出建立前沿 AI 标准机构的框架。

对 AGI 时间与影响的判断属于作者观点;文章并不证明这些预测必然实现。

← 返回每日归档