aiwillknow.AI 前沿观察每日 08:00 开始整理
本期研究 /

FIELD NOTES / 01

大模型LANGUAGE MODELS

关注模型能力、训练方法、长任务执行与开放生态。

推理多模态智能体
RESEARCH SNAPSHOT收录概览
06项研究与重要更新
按来源核对开放状态
开源 / 开放4
闭源2
待开放 / 核实0

EXPLORE THE FIELD

全部已收录研究6

按工作日期排列 · 新 → 旧
6 项工作
大模型开放权重 · MIT

DeepSeek V4.1 Flash

用非对称编码与解码降低长任务成本

552B MoE 采用因果编码器—解码器结构,输入、输出分别激活 8B 和 16B 参数,并加入原生视觉理解。核心看点是把长上下文缓存与智能体推理成本作为架构设计目标。

DeepSeek
模型架构KV缓存
阅读简报
大模型闭源 · 托管服务

GPT-6 Astra

能力提升之后,如何评估智能体的行为

Astra 系统卡除了报告能力与对齐评测,还披露思维链可监测性相对前代下降。它值得作为智能体行为研究材料:任务做得更强,并不意味着内部过程更容易被可靠监督。

OpenAI
智能体安全评测
阅读简报
大模型闭源 · 分级访问

Claude Fable / Mythos 5.1

同一底座,不同访问与防护边界

Fable 5.1 与 Mythos 5.1 使用同一模型,但配置不同防护与访问条件;前者一般可用,后者受限。官方同时展示编程、科学任务等进展,评测结果需连同工具框架和任务版本阅读。

Anthropic
编程科研
阅读简报
大模型开放权重 · 专用许可

Qwen3.8

旗舰能力走向开放权重

Qwen3.8 将旗舰级能力扩展到开放权重路线,提供超大 MoE 与 27B 版本,强调编程、专业工作和长程任务完成。除模型规模,还值得跟踪推理强度控制与多轮思考上下文保留。

Qwen · 阿里巴巴
智能体开放权重
阅读简报
大模型开放权重 · 专用许可

Kimi K3

原生视觉与百万级上下文的开放模型

原生多模态 K3 将 Kimi Delta Attention 与跨层 Attention Residuals 结合,以稀疏 MoE 扩展到 2.8T 参数。公开材料既讨论长程编程能力,也明确了大规模部署与缓存方面的工程要求。

Moonshot AI
长上下文多模态
阅读简报
大模型方法代码 · Apache-2.0

Jacobian Lens / J-space

研究模型没有写出来的内部推理

通过 Jacobian Lens 把内部激活映射到可读的词汇方向,研究一组可被报告、调节和用于多步推理的表示。作者称其具有全局工作空间特征,但明确不把它当作主观意识的证明。

Anthropic · Wes Gurnee、Jack Lindsey 等
可解释性内部表示
阅读简报