研究

总览 可解释性 对齐科学 经济研究

安全

承诺 负责任扩展 信任中心

学习

学院 开发者文档 模型 新闻

公司

关于 招贤纳士 联系我们
体验共振 登录

公告,包括那些更正。

发布、论文、政策,都在同一条信息流里。旧文章的说法被推翻了怎么办?改原文、写说明——绝不悄悄重发一遍了事。

筛选

2026 年 9 月 1 日

Cortex 5.1 与 Pulse 5.1

两款为跨天任务而生的模型。系统卡里同时写明:一项拒绝基准数字回落 9 个百分点——原数字有误,已撤回。

模型 系统卡 更正
阅读公告
2026 年 7 月 24 日

一个可引导的"保留答案"回路

新的可解释性工作,定位到“没把握就不答”背后的机制。三个没复现出来的实验也一并奉上——失败的部分才最有用。

可解释性 论文 代码
阅读论文
2026 年 6 月 30 日

负责任扩展政策,第三版

能力层级写明了防护措施和放行路径——连训练中途越过阈值会发生什么都写了。

政策 安全
阅读政策
2026 年 6 月 2 日

经济指数开放外部评审

方法论、抽样框、任务级暴露度量的已知缺陷,全部公开——研究者的质疑也尽管提。

经济学 数据集 公开评审
阅读更多
2026 年 5 月 14 日

面向经费不像我们的实验室的研究访问计划

给安全方向的学术团队提供额度、评测工具和工程时间,唯一不要求的就是结果对我们有利。

项目 资助
阅读更多
2026 年 4 月 19 日

多天智能体任务中的漂移

超过此前没埋点的时长后,指令遵从性开始可测地走样。六种缓解措施试下来,两种站得住。

对齐 评测
阅读论文
2026 年 3 月 7 日

事件日志,长期化

不等人问——安全相关的事故和整改,我们持续公开记录。

透明度
阅读日志
2026 年 1 月 21 日

提示缓存与批量推理正式可用

重复上下文的成本现在只有全新调用的一小部分;批量任务折价运行,24 小时内完成。

平台 价格
阅读更多
媒体

媒体垂询

采访、对已发表研究的评论或品牌素材,请联系传播团队。我们接受实名采访; 做不到的,也会直说。

订阅

通过邮件获取发布

每月一期的简短摘要:我们发表了什么、搞错了什么、接下来做什么。没有营销漏斗。

这是静态演示——表单不会发送任何内容。