研究

总览 可解释性 对齐科学 经济研究

安全

承诺 负责任扩展 信任中心

学习

学院 开发者文档 模型 新闻

公司

关于 招贤纳士 联系我们
试试 共振 登录

公告,包括那些更正。

产品发布、研究论文与政策更新放在同一个信息流里。当早前文章里的说法被证伪时, 我们会编辑原文并说明,而不是悄悄重发一遍。

筛选

2026 年 9 月 1 日

Cortex 5.1 与 Pulse 5.1

为跨越数天而非数轮的工作而生的两款模型。随附系统卡披露了一项拒绝基准回落 9 个百分点——此前的数字有误,我们已将其撤回。

模型 系统卡 更正
阅读公告
2026 年 7 月 24 日

一个可引导的"保留答案"回路

可解释性新工作,定位在不确定时抑制答案的机制。三个未能复现的引导实验也一并附上——失败才是有用的部分。

可解释性 论文 代码
阅读论文
2026 年 6 月 30 日

负责任扩展政策,第三版

能力层级现在写明防护措施与放行路径,包括训练中途越过阈值时会发生什么。

政策 安全
阅读政策
2026 年 6 月 2 日

经济指数开放外部评审

我们公开了方法论、抽样框,以及任务级暴露度量的已知缺陷,并公开征集研究者的质疑。

经济学 数据集 公开评审
阅读更多
2026 年 5 月 14 日

面向经费不像我们的实验室的研究访问计划

为安全相关方向的学术团队提供额度、评测工具与工程时间,不要求结果对我们有利。

项目 资助
阅读更多
2026 年 4 月 19 日

多天智能体任务中的漂移

指令遵从性在工具此前未埋点的时长之后出现可测退化。测试了六种缓解措施,两种站住了。

对齐 评测
阅读论文
2026 年 3 月 7 日

事件日志,长期化

与其被问到才说,我们持续公开记录安全相关事件,以及随之而来的改变。

透明度
阅读日志
2026 年 1 月 21 日

提示缓存与批量推理正式可用

重复上下文现在只需全新调用的一小部分成本;批量任务降价运行,24 小时内完成。

平台 价格
阅读更多
媒体

媒体垂询

采访、对已发表研究的评论或品牌素材,请联系传播团队。我们接受实名采访; 做不到的场合,也会直说做不到。

订阅

通过邮件获取发布

每月一期的简短摘要:我们发表了什么、搞错了什么、接下来做什么。没有营销漏斗。

这是静态演示——表单不会发送任何内容。