精选归档 · 第 14 页

261280 条 · 共 545

6月17日6月17日周三

星期三 · 1 条
03:25
OpenAI:官网动态(RSS · 排除企业/客户案例)精选
AI 评分 74/100
OpenAI 发布 Deployment Simulation 方法:通过模拟部署预测模型发布前行为

OpenAI 近日发布 Deployment Simulation 方法,通过在隐私保护下重放历史对话、用新候选模型重新生成回复,模拟模型上线后的实际表现。在多个 GPT‑5‑series Thinking 部署中,该方法比传统评估更准确地估计了不良行为频率,发现新型对齐问题,并降低模型识别测试的风险。它还能扩展至涉及工具使用的智能体场景。传统评估存在覆盖不足、选择偏差和模型可识别测试等局限,而 Deployment Simulation 使用真实对话分布缓解了这些问题,但无法测量频率低于每 20 万条消息 1 次的行为。


推荐理由:虽然只是安全评估方法,但OpenAI用130万真实对话验证,把预部署风险预测误差压到1.5倍,这套方法很可能成为未来模型发布前的标准动作。

6月16日6月16日周二

星期二 · 2 条
17:27
The Decoder:AI News(RSS)精选
AI 评分 75/100
OpenAI 去年支出 340 亿美元,净亏损约 390 亿但含一次性费用

OpenAI 过去一年支出 340 亿美元,其中约 190 亿投入研发,近 60 亿用于销售和营销。收入约 130 亿美元,年底月收入达 20 亿美元。净亏损从 50 亿跃升至约 390 亿美元,但《金融时报》指出其中约 300 亿为一次性非现金会计费用,剔除后实际亏损约 80 亿美元。OpenAI 正筹备 IPO,估值可能超 1 万亿美元。


推荐理由:花 340 亿才赚 130 亿,运营亏损 80 亿,但估值要冲万亿,这账本对 AI 公司的估值逻辑是个压力测试。
02:32
OpenRouter@OpenRouter精选
AI 评分 65/100
OpenRouter新增免费模型gpt-oss-20b和Gemma4 26BNew Free capacity on OpenRouter, served by @eigenlabs's Darkbloom: gpt-oss-20b and Gemma 4 26BStart using the models today ↓OpenRouter 上新增免费容量,由 @eigenlabs 的 Darkbloom 提供:gpt-oss-20b 和 Gemma 4 26B。 今天就开始使用这些模型吧 ↓

推荐理由:OpenRouter 免费层加了两个模型,其中一个名字暗示 Gemma 4,如果属实值得一看,否则就是一次普通的容量扩充,但对经常薅免费 API 的开发者来说多了选择。

6月15日6月15日周一

星期一 · 3 条
08:14
OpenAI:官网动态(RSS · 排除企业/客户案例)精选
AI 评分 59/100
OpenAI 推出合作伙伴网络 OpenAI Partner Network

OpenAI 宣布推出 OpenAI Partner Network,并投资 1.5 亿美元支持全球合作伙伴构建、销售和交付 AI 解决方案。该计划设立 Select、Advanced、Elite 三级合作伙伴层级,提供 Codex、网络安全、智能体等专业方向认证,并试点 Forward Deployed Experts 项目以支持复杂企业部署。目标在 2026 年底前培训认证 30 万名顾问。案例显示,Paychex 借助 Bain 和 OpenAI 的方案将等待时间降低 80%,人工审核时间减少 30%。


推荐理由:OpenAI 砸 1.5 亿建合作伙伴网络,企业落地从模型能力转向生态整合,但这事离普通用户比较远,更像是给咨询公司派活。
05:45
Tibo@thsottiaux精选
AI 评分 68/100
Codex 自主设定目标,通用化元提示Codex can see and set its own /goal. Everything we build, we build also as a tool for the agent. This is a generalization of meta prompting, where you let the agent set its own task based on your intent.Codex 可以查看并设置它自己的 /goal。 我们所构建的一切,也都是作为该智能体的工具而构建的。 这是元提示的一种泛化,即让智能体根据你的意图自行设定任务。

Pietro Schirano: I basically never write my own /goal anymore. I ask Codex to write one for itself, and one for each agent it spawns. Lik...


推荐理由:让 Agent 自己给自己写 /goal 这个思路很小但很实用,把 meta prompting 泛化成工具调用后,Codex 用户可以直接抄作业,手写指令的痛苦省掉一大半。
00:50
Gary Marcus:The Road to AI We Can Trust(RSS)精选
AI 评分 65/100
白宫AI监管决定被指偏袒OpenAI与亚马逊

白宫周五做出的AI监管决定被指偏袒OpenAI、亚马逊等企业,同时对Anthropic施压不足24小时,缺乏透明度和事实依据。Gary Marcus、Dean W Ball及卡托研究所Kevin Frazier等专家指出,这种由少数人闭门快速决策的做法带有腐败嫌疑,可能促使其他国家加速发展“主权AI”甚至中国AI,并导致美国人才流失。Anthropic声明称政府应在法定程序中基于技术事实阻止不安全部署,而非当前方式。Marcus呼吁建立独立机构负责AI监管,确保公平、清晰、基于证据的执行。


推荐理由:白宫对 Anthropic 的仓促禁令不仅是监管失灵,更可能触发全球 AI 主权竞赛和人才外流。Marcus 呼吁独立的透明机构,这篇分析指出了美国 AI 行业最紧迫的制度缺口。

6月13日6月13日周六

星期六 · 2 条
03:43
Greg Brockman@gdb精选
AI 评分 71/100
OpenAI 新文档智能体上线,导航更直观powerful & cool way to navigate a website, makes it feel so much more interactive and intuitiveOpenAI 在开发者文档网站上线了新的文档智能体,可帮助查找产品相关信息并直接跳转到对应文档。Greg Brockman 表示这是一种强大且酷的网站导航方式,让交互更加直观。

OpenAI Developers: Ask our developer docs. They’ll show you the way The new docs agent on 🔗http://developers.openai.com helps you find ans...


推荐理由:OpenAI 在开发者文档里嵌了个问答代理,能让开发者直接问文档,对常翻阅 API 的人挺实用。虽然不算大突破,但改善了开发体验,值得一试。
01:01
OpenAI:官网动态(RSS · 排除企业/客户案例)精选
AI 评分 57/100
OpenAI 推出面向新时代工作的新 Academy 课程

OpenAI 发布三门 Academy 课程,帮助用户掌握实用 AI 技能、创建可重复工作流,并在日常工作中应用 AI 智能体。


推荐理由:OpenAI 官方第一次把模型使用经验整理成有体系的三段式课程,从基础提示到 agent 工作流,对想在职场中真正用起来的人是个实在的起点。

6月12日6月12日周五

星期五 · 5 条
03:39
Tibo@thsottiaux精选
AI 评分 71/100
OpenAI收购Ona,增强Codex云端执行Codex 🤟OnaBeyond excited to work with Johannes and team to build the future.OpenAI宣布已达成协议收购Ona,其安全的云执行技术将帮助Codex处理更长期的任务(即使笔记本电脑关闭也能运行),并让更多组织安全地部署智能体。收购完成后,Ona将加入OpenAI的Codex团队。Tibo对此表示"无比兴奋,期待与Johannes及团队共同构建未来"。

OpenAI Newsroom: We’ve reached an agreement to acquire @ona_hq. Its secure cloud execution technology will help Codex take on longer-runn...


推荐理由:OpenAI在填Codex的坑,关掉笔记本还能跑任务这件事比听起来更难,收购Ona是在解决真实工程问题,做产品的人应该留意这个信号。
03:29
Rohan Paul@rohanpaul_ai精选
AI 评分 82/100
WSJ:OpenAI 考虑大幅降价,同准备 ChatGPT 史上最大改版备战 IPOWSJ: OpenAI is considering deep price reductions as competition with Anthropic intensifies.Anthropic is pressuring OpenAI because its strongest growth is coming from developer and coding workflows, specially with Claude Code, where users can generate huge token volume every day and quickly make Claude part of their normal work.OpenAI is still the bigger consumer brand, but in this fight the valuable prize is not casual chat users, it is enterprise teams paying metered bills for coding agents, automation, and internal tools.The difference is that Anthropic seems to have a sharper wedge in high-spend technical work, while OpenAI has to defend ChatGPT’s broad lead and stop Claude from becoming the default tool inside companies.---wsj. com/tech/ai/openai-considers-drastic-price-cuts-anticipating-war-for-users-with-anthropic-9b8c178eWSJ 报道,OpenAI 正考虑大幅降价以应对与 Anthropic 的竞争。Anthropic 增长主要来自开发者和编码工作流,Claude Code 消耗大量 token,已让企业团队将其融入日常工作。OpenAI 虽在消费品牌上更大,但企业市场才是关键--企业为编码智能体、自动化等工具付费。同时,OpenAI 在 IPO 前准备对 ChatGPT 进行史上最大改版,将其打造成涵盖编码、AI 智能体、图像生成和商业软件的超级应用,改版将在未来几周陆续推出。OpenAI 将更多资源投入编码工具 Codex,目标实现 Codex 工程负责人所说的"个人智能体"。

Rohan Paul: OpenAI is preparing its biggest ChatGPT redesign yet, before its IPO. To make it into a superapp for coding, AI agents, ...


推荐理由:WSJ这篇把OpenAI的窘境说清了,C端用户再多也不如开发者每天烧token来钱,所以降价是必然,但ChatGPT变超级应用是在抄Anthropic的作业。
00:39
OpenAI:官网动态(RSS · 排除企业/客户案例)精选
AI 评分 61/100
OpenAI 将收购 Ona

OpenAI 计划收购 Ona,以拓展 Codex 的功能,提供安全、持久的云端环境,从而支持企业工作流中长时间运行的 AI 智能体。


推荐理由:OpenAI收购Ona,给Codex补上持久化云环境,让Agent能长时间自主工作。这是把AI Agent从会话工具变成企业级生产平台的一个基础设施信号。

6月11日6月11日周四

星期四 · 4 条
04:03
OpenAI:官网动态(RSS · 排除企业/客户案例)精选
AI 评分 55/100
OpenAI报告:PRC关联影响力行动瞄准美国AI辩论

OpenAI发布最新报告,详细披露了PRC关联的影响力行动利用AI工具干扰美国科技辩论、数据中心选址叙事、关税政策讨论,并散布关于ChatGPT的虚假指控。


推荐理由:OpenAI 首次公开两起与中国关联的 AI 认知操控案例,手法直接针对数据中心和关税辩论,虽然未发现广泛扩散,但对 AI 基础设施为目标的攻击值得警惕,安全团队可以借鉴这种威胁建模。
02:52
The Decoder:AI News(RSS)精选
AI 评分 75/100
OpenAI 的 IPO 推迟,Altman 告诉员工预计上市"在一年内"

Sam Altman 对员工表示,他预计 OpenAI 的 IPO 将在“一年内”进行,但可能推迟至 2027 年。他将这一延迟归因于对自我改进 AI 的谨慎态度,不过 Anthropic 更强的增长数据及其即将到来的 IPO 或许是更实际的等待理由。


推荐理由:Altman 首次对员工明确 IPO 时间表,尽管可能推迟到 2027,这消息对行业和员工都是定心丸。Anthropic 的压力才是真正的钟,不是‘自改进 AI’的借口。

6月10日6月10日周三

星期三 · 2 条