Anthropic 发布与 OpenAI 对齐互评试点的结果
Anthropic 于 8 月 27 日发布与 OpenAI 在 2025 年 6 月至 7 月初进行的对齐互评试点结果,双方用各自的内部对齐评估测试对方公开模型。
推荐理由:Anthropic 与 OpenAI 互评对齐的一次早期实践,作者还给出了自家评估的局限与改进方向,对理解跨实验室对齐评估的可行做法有参考价值。
公司与模型
OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事的持续追踪。
815 条精选近 30 天 146 条共收录 5,741 条
Anthropic 于 8 月 27 日发布与 OpenAI 在 2025 年 6 月至 7 月初进行的对齐互评试点结果,双方用各自的内部对齐评估测试对方公开模型。
推荐理由:Anthropic 与 OpenAI 互评对齐的一次早期实践,作者还给出了自家评估的局限与改进方向,对理解跨实验室对齐评估的可行做法有参考价值。
OpenAI 与 Anthropic 发布了一项此前未有的联合安全评估结果,两家实验室互相测试对方模型在失齐、指令遵循、幻觉、越狱等方面的表现,指出跨实验室协作的进展与挑战。
推荐理由:两大实验室互相评测对方模型的失齐、越狱等安全问题,正文透露了跨实验室协作的具体评估维度。
GPT-5 不再需要详细提示工程,只需给出目标即可自主完成任务。将 AI 置于主导地位,用户只需设定方向,具体执行由模型自行处理。
推荐理由:Ethan Mollick 深度解读 GPT-5 自主执行能力,洞察 AI 代理新范式
OpenAI 宣布在 API 平台推出 GPT-5,面向开发者提供高推理性能和新的开发者控制项,并在真实编码任务上取得同级最优结果。
推荐理由:官方公告说明 GPT-5 进入 API 平台并面向开发者提供新控制项,读者可据此评估是否迁移现有调用。
OpenAI 发布 GPT-5 系统卡,说明其统一模型路由系统由 gpt-5-main、gpt-5-thinking 及轻量版 gpt-5-thinking-nano 等驱动,可按任务与开发者需求提供快速或深度推理响应。
推荐理由:系统卡解释了 GPT-5 的统一模型路由机制及各变体的分工,有助于理解不同场景下如何选用对应版本。
OpenAI 发布 GPT-5 初览内容,展示多位领先开发者首次使用 GPT-5 的情况。
推荐理由:原文汇集多位领先开发者首次使用 GPT-5 的实测反应,可提供第一手使用体验参考。
OpenAI 发布 GPT-5,称其为迄今最好的 AI 系统,智能水平较此前所有模型有显著跃升。官方表示 GPT-5 在编码、数学、写作、健康、视觉感知等多个领域具备最先进的性能。
推荐理由:官方宣布 GPT-5 发布,并点出编码、数学、写作、健康与视觉感知等多个方向的能力提升,可了解其定位。
OpenAI 发布 Cookbook 教程,讲解如何在本地硬件上用 LM Studio 运行 gpt-oss。LM Studio 是一款在本地硬件运行大语言模型的桌面应用,教程将引导用户完成本地运行 gpt-oss 的步骤。
推荐理由:OpenAI 官方 Cookbook 给出在本地硬件用 LM Studio 运行 gpt-oss 的完整步骤,可作为离线部署的操作参考。
OpenRouter 平台已发布 GPT-5,该模型支持长上下文,专为复杂推理与代码工作流构建。
推荐理由:这是 GPT-5 首次以大上下文和推理能力亮相,1M token 上下文让 code agent 直接从 demo 变成可用,现在看虽是旧闻,但节点意义不减。
GPT-5 已在 OpenRouter 平台正式推出。该模型具备长上下文处理能力,专门针对复杂推理任务与代码工作流进行了优化。此次发布标志着新一代大语言模型开始接入开放路由网络,为开发者与用户提供更强大的多步骤逻辑处理和编程辅助功能。
推荐理由:OpenRouter 上架 GPT-5 本身不算新闻,但对用 OpenRouter 做多模型路由的开发者来说,这是终于能切到最新旗舰的信号,值得第一时间跑一遍自己的 benchmark。
OpenAI 发布文章,介绍 GPT-5 采用的 safe-completions 方法,用以输出为中心的安全训练取代硬拒答。该方法针对双用途提示词给出更细致的回应,兼顾安全性与有用性。
推荐理由:原文介绍了 GPT-5 用以输出为中心的安全训练取代硬拒答,读者可了解双用途提示下兼顾安全与实用性的思路。
推荐理由:OpenAI 终于开源了,这是 GPT-2 之后第一次放开权重,120B 和 20B 两个尺寸直接对标 Llama 和 Qwen 的开源生态。虽然游戏 benchmark 排名不算惊艳,但信号本身比分数重要得多,所有基于开源模型做产品的团队都得重新评估选型。
OpenAI for Government 宣布与美国总务管理局(GSA)达成新合作,未来一年内 ChatGPT Enterprise 将以几乎零成本向美国联邦行政部门全体工作人员开放。
推荐理由:原文是官方公告,明确了服务范围和为期一年的免费安排,可了解联邦政府采用 AI 工具的动向。
OpenAI 发布两款新的开放模型(open models),官方推文称"Both of them"已上线,详见 openai.com/open-models。
我们的开放模型来了。 两个都有。 http://openai.com/open-models
推荐理由:OpenAI罕见发布开放权重模型,标志策略重大转变
OpenAI 发布 gpt-oss-120b 和 gpt-oss-20b 两款开放权重语言模型,采用 Apache 2.0 许可证。两款模型在推理任务上优于同等规模的开源模型,具备较强的工具使用能力,并针对消费级硬件的低成本高效部署做了优化。
推荐理由:原文说明两款开放权重模型的推理表现、工具使用能力和消费级硬件部署定位,可帮助读者评估是否引入自建流程。
OpenAI 发布 gpt-oss-120b 和 gpt-oss-20b 两个开源权重推理模型,采用 Apache 2.0 许可证,并遵循其 gpt-oss 使用政策。
OpenAI 发布开源权重模型家族 GPT OSS,包含 117B 参数的 gpt-oss-120b 和 21B 参数的 gpt-oss-20b,均采用 MoE 架构和 MXFP4 4-bit 量化,以 Apache 2.0 许可发布。
推荐理由:原文给出两个模型的参数规模、量化方案和各硬件下的部署优化路径,读者可以据此快速选择本地或云端运行方式。
OpenAI 开发者发布教程,讲解如何用 Ollama 在本地硬件上部署 gpt-oss-20b 或 gpt-oss-120b 并选择合适的推理设置。
推荐理由:来自 OpenAI 开发者官方的实操指南,读者可按步骤在自己硬件上用 Ollama 跑通 gpt-oss 两个规格模型。
OpenAI 开发者 Cookbook 发布教程,讲解如何结合 gpt-oss 与 Hugging Face Transformers 进行微调。文章由 Edward Beeching、Quentin Gallouédec 和 Lewis Tunstall 撰写,并从大型推理模型(如 OpenAI o3)通过生成思维链提升准确性的背景切入。
推荐理由:官方 Cookbook 教程给出用 Hugging Face Transformers 微调 gpt-oss 的具体路径,适合需要本地定制推理模型的开发者参考。
OpenAI 宣布推出 Stargate Norway,这是其在欧洲的首个 AI 数据中心计划,隶属 OpenAI for Countries 项目。Stargate 是 OpenAI 的整体基础设施平台,是其让所有人受益于 AI 的长期愿景的关键组成部分。
推荐理由:原文由 OpenAI 官方发布,读者可了解其通过 OpenAI for Countries 在欧洲布局 AI 数据中心的动作。