跳到正文
2026 年 10 月 1 日 · 星期四每天 08:00 出刊

AI 日报 · 2026 年 10 月 1 日 · 星期四

AIHOT · AIHOT.NEWS

第 163 期012026 年 10 月星期四
27件大事20个来源14件一手发布7个新模型约 10 分钟读完
头条

OpenAI 被曝无视员工安全警告,FTC 启动 AI 实验室调查

《纽约时报》报道称,OpenAI 员工在模型失控前数月已邮件警告高层测试监控不足,但被要求按期发布。同日,FTC 以消费者保护为由对 OpenAI、Anthropic 等头部 AI 实验室启动调查,并计划强制调取文件、质询高管。

01

模型发布/更新

02

产品发布/更新

Arena

Arena 开放限时测试 Claude Sonnet 5.5,Direct Mode 可用 48 小时

Arena 宣布在 Direct Mode 限时开放 Anthropic 的 Claude Sonnet 5.5(High),截止 10 月 2 日上午 8 点(太平洋时间),之后仍可在 Battle 和 Agent Mode 使用。引用内容称 Claude Sonnet 5.5 是 Claude 5.5 系列第二款模型,比 Sonnet 5 快 30% 以上,多数工作成本最高降低 30%。

Aravind Srinivas

Perplexity 开放 Computer 邮件委托入口并限时免费运行任务

Perplexity 向所有人开放 Computer 的邮件委托功能,无需 Perplexity 账号,将转发或抄送 computer@perplexity.com 的任务限时免费运行。智能体会在后台完成任务并保留邮件上下文,每个邮件任务在 Computer 中作为正常会话运行,可在网页和移动端查看,并带有与应用内任务相同的审计记录。

03

行业动态

Ars Technica:AI

Trump 推动二十余家科技公司签署自愿性 AI 安全协议

约二十余家科技公司签署白宫超级智能协议,承诺实施独立安全审计、定期会商并制定共同安全标准,涵盖网络安全、生物安全和化学威胁等风险。协议无法律约束力,Trump 称其具有道德约束力。文章指出 OpenAI 近期多起事故源于今年 5 至 7 月开发中的一个未发布模型,其安全委员会有效性受到特拉华和加州总检察长调查,FTC 也就 AI 智能体潜在消费者损害发起调查。

04

论文研究

05

技巧与观点

OpenRouter:Announcements一手

OpenRouter 教程:如何从生产流量构建 golden 评测集并跨模型复测

OpenRouter 发布教程,讲解如何从生产流量构建 golden 评测集,作为每次部署前的回归测试。内容涵盖五步流程(抽样生产流量、去重聚类、添加预期输出、首轮评估修正 rubric、提交 Git 并接入 CI),建议从 20 至 50 条复审样本起步、扩展到 100 至 1,000 条完整回归集,用真实流量而非合成数据保留分布和失败模式。

06

快讯

(本期完)

AIHOT 日报由编辑系统根据公开来源自动编辑,每条均附原文 · 日报合订本