Topic · 主题全部主题 →

OpenAI / ChatGPT

OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事的持续追踪。

4,648条收录
516条精选

精选归档 · 第 13 页

241260 条 · 共 516

6月18日6月18日周四

星期四 · 5 条
09:43
jason@jxnlco精选
AI 评分 83/100
Noam Shazeer 加入 OpenAI,告别 GoogleI’m so excitedNoam Shazeer 宣布将加入 OpenAI,期待与那里的优秀团队合作。离开 Google 是一个艰难的决定,他为 Google 的团队和共同取得的成就感到自豪。

Noam Shazeer: 我很激动地宣布,我将加入 OpenAI,并期待与那里卓越的团队共事。 离开是一个艰难的决定。我为谷歌那支出色的团队以及我们共同打造的一切感到无比自豪。能与你们所有人共事,是我的荣幸和快乐。

另有 7 家信源报道The Decoder:AI News(RSS)Hacker News 热门(buzzing.cc 中文翻译)X:Yuchen Jin (@Yuchenj_UW)IT之家(RSS)X:Kim (@kimmonismus)X:Sam Altman (@sama)TechCrunch:AI(RSS)
推荐理由:Transformer 共同发明人 Noam Shazeer 从 Google 跳槽 OpenAI,这是今年最大的人事变局之一,对两家公司的模型路线都有深远影响。
09:20
OpenRouter:Announcements(RSS)精选
AI 评分 57/100
如何在 OpenRouter 上使用 OpenAI Codex CLI

Codex CLI 支持自定义 OpenAI 兼容提供商,只需在 config.toml 中配置即可将请求路由到 OpenRouter。用户无需修改 Codex 本身,就能获得提供商故障转移、使用跟踪以及跨所有模型的统一密钥。


推荐理由:这篇教程教开发者如何将 OpenAI Codex CLI 路由到 OpenRouter,配置不复杂,对想用 Codex 又希望多模型切换的朋友是个顺手的小贴士。
08:22
07:13
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 78/100
泄露文件显示OpenAI年营收130亿但亏损远超收入

OpenAI 2025年营收130.7亿美元(2024年37亿),但研发成本达191.8亿(含向微软支付105.9亿),收入成本(推理计算)75亿,销售营销成本57.3亿,运营亏损209.2亿。2025年净亏损约390亿,扣除约300亿一次性会计费用后约80亿。2025年3月获1220亿融资(估值8520亿)。ChatGPT周活超9亿,付费约5000万。为控制成本已关闭Sora视频模型并削减非核心业务。

另有 2 家信源报道Hacker News 热门(buzzing.cc 中文翻译)Ars Technica:AI(RSS)
推荐理由:OpenAI 的财务窟窿比想象的大,2025 年研发成本 191 亿,仅给微软的算力费就花了百亿,这种烧钱速度对 IPO 定价和整个行业的定价逻辑都有冲击。
04:42
OpenAI:官网动态(RSS · 排除企业/客户案例)精选
AI 评分 58/100
LifeSciBench 发布

2026 年 6 月,OpenAI 联合 173 位博士级生命科学家发布 LifeSciBench 评测基准,涵盖 750 个真实研究任务,覆盖证据处理、分析、设计优化等七个工作流及七个生物领域。每项任务配有约 25 条细化评分标准(共 19,020 条),评估模型的科学正确性与实用价值。79% 的任务需多步推理,53% 要求解读图表、PDF 等附件数据,旨在衡量 AI 在复杂、不确定的研究任务中的实际能力,而非仅回答结构化问题。

另有 1 家信源报道X:OpenAI (@OpenAI)
推荐理由:OpenAI 这个基准请了 173 位博士级科学家出题,第一次把 AI 评估拉到真实科研决策里。结果很实在:前沿模型在需要结合复杂图表、设计实验的任务上仍然乏力,做 AI for Science 的团队值得拿来校准预期。

6月17日6月17日周三

星期三 · 5 条
13:05
IT之家(RSS)精选
AI 评分 73/100
消息称 OpenAI 今年一季度现金消耗达 37 亿美元,超同期收入的一半

OpenAI 在 2026 年第一季度现金消耗达 37 亿美元,超过同期 57 亿美元收入的一半。数据来自一份向股东披露的文件,直观体现 AI 大模型研发与规模化落地的巨额成本。OpenAI 正筹备上市,已在美国保密递交 IPO 申请,最早或于 9 月完成,估值最高可达 1 万亿美元。头部 AI 企业持续重金投入算力、模型研发与人才招募以维持竞争优势。


推荐理由:OpenAI上市前夕的财务快照:一季度烧掉37亿,占收入一半多,万亿估值背后是疯狂军备竞赛。对关注AI商业可持续性的人,这是关键数据点。
12:23
Greg Brockman@gdb精选
AI 评分 74/100
GPT-Realtime-2:用语音控制操作系统GPT-Realtime-2 is something newGreg Brockman 称 GPT-Realtime-2 是全新事物。@per_simmons_ 体验数周后表示,GPT-Realtime-2 是操作系统的未来,仅用语音即可打开应用、搜索网页、编辑 Premiere Pro,设置只需几个提示词且无需编码。视频演示了通过 MCP 连接 Obsidian 以及利用无障碍树控制 Premiere Pro 等功能。

Pat Simmons: GPT-Realtime 2 is the future of the operating system. I've been experimenting with it for a couple weeks now, and I gott...


推荐理由:Greg Brockman 转发的这个视频,演示了用语音控制 OS 完成搜索、写笔记、甚至剪辑 Premiere,这不是 demo 动画,是真的可以上手试的教程,让人感觉语音 OS 离现实又近了一步。
06:04
Gary Marcus:The Road to AI We Can Trust(RSS)精选
AI 评分 62/100
OpenAI 的领先优势正在快速缩小

评论认为 OpenAI 正面临多重危机:缺乏护城河导致市场领先地位下滑;最大投资者微软持续疏远,近期甚至公开考虑将主要产品外包给中国;亏损速度远超预期,年亏损额以 8 倍增长。华盛顿方面可能打压 Anthropic,但也可能反而帮助其崛起,而 Elon Musk 成为另一个潜在的竞标者。


推荐理由:Gary Marcus 这次拿出了市场份额和微软疏远的证据,比以往的情绪化唱衰更有说服力。如果你还相信 OpenAI 的地位不可动摇,这篇值得一看。
03:52
OpenAI:Alignment 研究博客(RSS)精选
AI 评分 73/100
公开聊天数据能否预测真实世界AI失调?

OpenAI利用WildChat公开数据集(2023年4月至2024年5月收集的100万条对话)模拟模型部署,预测GPT-5.1、GPT-5.2、GPT-5.4在真实生产环境中的不良行为率。与私有生产数据对比发现,WildChat模拟的平均预测误差约3倍;但对技术性和智能体型失调的预测精度下降。研究验证了公开数据集作为外部审计工具的可行性。


推荐理由:用公开旧聊天数据预测模型真实失败率,误差居然在 3 倍以内,做外部审计的可以认真看看。不过 agentic 场景明显不行,需要新数据集。
03:25
OpenAI:官网动态(RSS · 排除企业/客户案例)精选
AI 评分 74/100
OpenAI 发布 Deployment Simulation 方法:通过模拟部署预测模型发布前行为

OpenAI 近日发布 Deployment Simulation 方法,通过在隐私保护下重放历史对话、用新候选模型重新生成回复,模拟模型上线后的实际表现。在多个 GPT‑5‑series Thinking 部署中,该方法比传统评估更准确地估计了不良行为频率,发现新型对齐问题,并降低模型识别测试的风险。它还能扩展至涉及工具使用的智能体场景。传统评估存在覆盖不足、选择偏差和模型可识别测试等局限,而 Deployment Simulation 使用真实对话分布缓解了这些问题,但无法测量频率低于每 20 万条消息 1 次的行为。

另有 1 家信源报道MarkTechPost(RSS)
推荐理由:虽然只是安全评估方法,但OpenAI用130万真实对话验证,把预部署风险预测误差压到1.5倍,这套方法很可能成为未来模型发布前的标准动作。

6月16日6月16日周二

星期二 · 2 条
17:27
The Decoder:AI News(RSS)精选
AI 评分 75/100
OpenAI 去年支出 340 亿美元,净亏损约 390 亿但含一次性费用

OpenAI 过去一年支出 340 亿美元,其中约 190 亿投入研发,近 60 亿用于销售和营销。收入约 130 亿美元,年底月收入达 20 亿美元。净亏损从 50 亿跃升至约 390 亿美元,但《金融时报》指出其中约 300 亿为一次性非现金会计费用,剔除后实际亏损约 80 亿美元。OpenAI 正筹备 IPO,估值可能超 1 万亿美元。

另有 2 家信源报道Hacker News 热门(buzzing.cc 中文翻译)Ars Technica:AI(RSS)
推荐理由:花 340 亿才赚 130 亿,运营亏损 80 亿,但估值要冲万亿,这账本对 AI 公司的估值逻辑是个压力测试。
02:32
OpenRouter@OpenRouter精选
AI 评分 65/100
OpenRouter新增免费模型gpt-oss-20b和Gemma4 26BNew Free capacity on OpenRouter, served by @eigenlabs's Darkbloom: gpt-oss-20b and Gemma 4 26BStart using the models today ↓OpenRouter 上新增免费容量,由 @eigenlabs 的 Darkbloom 提供:gpt-oss-20b 和 Gemma 4 26B。 今天就开始使用这些模型吧 ↓

推荐理由:OpenRouter 免费层加了两个模型,其中一个名字暗示 Gemma 4,如果属实值得一看,否则就是一次普通的容量扩充,但对经常薅免费 API 的开发者来说多了选择。

6月15日6月15日周一

星期一 · 3 条
08:14
OpenAI:官网动态(RSS · 排除企业/客户案例)精选
AI 评分 59/100
OpenAI 推出合作伙伴网络 OpenAI Partner Network

OpenAI 宣布推出 OpenAI Partner Network,并投资 1.5 亿美元支持全球合作伙伴构建、销售和交付 AI 解决方案。该计划设立 Select、Advanced、Elite 三级合作伙伴层级,提供 Codex、网络安全、智能体等专业方向认证,并试点 Forward Deployed Experts 项目以支持复杂企业部署。目标在 2026 年底前培训认证 30 万名顾问。案例显示,Paychex 借助 Bain 和 OpenAI 的方案将等待时间降低 80%,人工审核时间减少 30%。


推荐理由:OpenAI 砸 1.5 亿建合作伙伴网络,企业落地从模型能力转向生态整合,但这事离普通用户比较远,更像是给咨询公司派活。
05:45
Tibo@thsottiaux精选
AI 评分 68/100
Codex 自主设定目标,通用化元提示Codex can see and set its own /goal. Everything we build, we build also as a tool for the agent. This is a generalization of meta prompting, where you let the agent set its own task based on your intent.Codex 可以查看并设置它自己的 /goal。 我们所构建的一切,也都是作为该智能体的工具而构建的。 这是元提示的一种泛化,即让智能体根据你的意图自行设定任务。

Pietro Schirano: I basically never write my own /goal anymore. I ask Codex to write one for itself, and one for each agent it spawns. Lik...


推荐理由:让 Agent 自己给自己写 /goal 这个思路很小但很实用,把 meta prompting 泛化成工具调用后,Codex 用户可以直接抄作业,手写指令的痛苦省掉一大半。
00:50
Gary Marcus:The Road to AI We Can Trust(RSS)精选
AI 评分 65/100
白宫AI监管决定被指偏袒OpenAI与亚马逊

白宫周五做出的AI监管决定被指偏袒OpenAI、亚马逊等企业,同时对Anthropic施压不足24小时,缺乏透明度和事实依据。Gary Marcus、Dean W Ball及卡托研究所Kevin Frazier等专家指出,这种由少数人闭门快速决策的做法带有腐败嫌疑,可能促使其他国家加速发展“主权AI”甚至中国AI,并导致美国人才流失。Anthropic声明称政府应在法定程序中基于技术事实阻止不安全部署,而非当前方式。Marcus呼吁建立独立机构负责AI监管,确保公平、清晰、基于证据的执行。


推荐理由:白宫对 Anthropic 的仓促禁令不仅是监管失灵,更可能触发全球 AI 主权竞赛和人才外流。Marcus 呼吁独立的透明机构,这篇分析指出了美国 AI 行业最紧迫的制度缺口。

6月13日6月13日周六

星期六 · 2 条
03:43
Greg Brockman@gdb精选
AI 评分 71/100
OpenAI 新文档智能体上线,导航更直观powerful & cool way to navigate a website, makes it feel so much more interactive and intuitiveOpenAI 在开发者文档网站上线了新的文档智能体,可帮助查找产品相关信息并直接跳转到对应文档。Greg Brockman 表示这是一种强大且酷的网站导航方式,让交互更加直观。

OpenAI Developers: Ask our developer docs. They’ll show you the way The new docs agent on 🔗http://developers.openai.com helps you find ans...


推荐理由:OpenAI 在开发者文档里嵌了个问答代理,能让开发者直接问文档,对常翻阅 API 的人挺实用。虽然不算大突破,但改善了开发体验,值得一试。
01:01
OpenAI:官网动态(RSS · 排除企业/客户案例)精选
AI 评分 57/100
OpenAI 推出面向新时代工作的新 Academy 课程

OpenAI 发布三门 Academy 课程,帮助用户掌握实用 AI 技能、创建可重复工作流,并在日常工作中应用 AI 智能体。


推荐理由:OpenAI 官方第一次把模型使用经验整理成有体系的三段式课程,从基础提示到 agent 工作流,对想在职场中真正用起来的人是个实在的起点。

6月12日6月12日周五

星期五 · 3 条
03:39
Tibo@thsottiaux精选
AI 评分 71/100
OpenAI收购Ona,增强Codex云端执行Codex 🤟OnaBeyond excited to work with Johannes and team to build the future.OpenAI宣布已达成协议收购Ona,其安全的云执行技术将帮助Codex处理更长期的任务(即使笔记本电脑关闭也能运行),并让更多组织安全地部署智能体。收购完成后,Ona将加入OpenAI的Codex团队。Tibo对此表示"无比兴奋,期待与Johannes及团队共同构建未来"。

OpenAI Newsroom: We’ve reached an agreement to acquire @ona_hq. Its secure cloud execution technology will help Codex take on longer-runn...

另有 1 家信源报道X:Greg Brockman (@gdb)
推荐理由:OpenAI在填Codex的坑,关掉笔记本还能跑任务这件事比听起来更难,收购Ona是在解决真实工程问题,做产品的人应该留意这个信号。