AI 日报 · 2026 年 10 月 8 日 · 星期四
AIHOT · AIHOT.NEWS

OpenAI 向全部 ChatGPT 用户推出 GPT-6 与 Intelligent UI
OpenAI 发布面向更广泛用户的 GPT-6,并随 GPT-6 在 ChatGPT 中引入 Intelligent UI,可生成图形、按钮、表单、图表和可交互组件来回答问题。
模型发布/更新
Anthropic 发布 Claude Haiku 5.5,运行成本平均降低约 75%
Anthropic 发布 Claude Haiku 5.5,定位为迄今最便宜、最快的小模型,适合摘要、压缩、数据库查询、分类等高吞吐任务,并可搭配 Opus 5.5 和 Sonnet 5.5 担任编码子智能体。
产品发布/更新
Anthropic 为 Claude Max 和 Team 套餐推出月度 Platform API 额度
Anthropic 正在为 Claude Max 和 Team 套餐推出月度 Claude Platform API 额度:Max 5x 为 $100,Max 20x 为 $200,Team 最多 $500 且可共享。额度适用于任何模型,包括 Haiku 5.5,可在自己的代码或第三方 harness 中使用。
OpenAI Decisions API 公测上线
OpenAI 推出 Decisions API 公开测试版,向所有开发者开放,可让应用在接近实时的速度下选择合适的模型、工具或动作。官方称其决策速度最高比通过 Responses API 的 GPT-6 Luna 快 10 倍,作者表示团队将自用该 API 以多种方式改进体验。
- GPT-6 Luna Decisions 上架 OpenRouterOpenRouter
Claude Code v2.1.293 发布:新增 Claude Haiku 5.5 并修复大量问题
Claude Code 发布 v2.1.293,新增 Claude Haiku 5.5(claude-haiku-5-5)作为 Anthropic API 默认 Haiku 模型,支持 1M 上下文,价格为 $0.10/$0.50 每百万 token(超 100K 提示为 $0.50/$2.50)。
NVIDIA 与 Microsoft 发布 RTX Spark 及 DGX Station for Windows,推动 AI Agent 落地 Windows PC
NVIDIA 与 Microsoft 在旧金山 Windows AI 和 Surface 活动上宣布为 Windows PC 引入 AI Agent 硬件与软件。
Google 推出实验性游戏平台 Playground,用提示词即可创建游戏
Google 推出实验性游戏平台 Playground,用户通过文本提示词即可创建、游玩和分享自定义游戏,无需编程经验。
行业动态
亚利桑那州法院裁定 AI 生成受害者视频带有不当情感分量 将重新量刑
亚利桑那州上诉法院裁定,Gabriel Horcasitas 2021 年路怒枪杀 Christopher Pelkey 一案维持过失杀人定罪,但因量刑听证中播放的 AI 生成受害者视频带有不当情感分量,法官须重新考虑刑期。
论文研究
Google Research 三个月专利起草实验发现AI辅助未必能培养初级律师的专业判断
Google Research 在 NBER 发表的论文报告了一项三个月随机田野实验,向11家知识产权律所的133名律师随机开放当时未发布的 AI 专利写作助手(现属 Gemini Notebook)。
Microsoft Research Asia 开源 Agent Lightning v1.0:3,500 行代码的真实 harness 智能体 RL 训练框架
Microsoft Research Asia 提出 Harnessed Agentic RL 训练范式并开源重建的 Agent Lightning v1.0,让部署时使用的同一 agent harness 直接参与强化学习,无需在训练框架内重写 agent。
技巧与观点
Google 开放 SynthID Detector 门户,可检测图片、视频和音频是否由 AI 生成
Google 介绍检测媒体是否由 AI 生成的方法:访问 https://synthid.com 上传图片、视频或音频文件,门户会扫描文件是否包含来自 Google 或其合作伙伴的 SynthID 水印。
a16z 解析德州为何让数据中心排队等电
a16z 的 Ryan McEntush 分析德州电网暂停审批数据中心的原因:并网队列从 2024 年底的 63 GW 激增到今年 6 月的 474 GW,约 90% 是数据中心,开发商大量投机性申请且社区沟通不足。
快讯
- Nemotron 系列微调后达到 IOI 2026 与 IMO 2026 金牌水平Hugging Face 社区博客
- LlamaIndex 发布 OpenDocRouter:一个 API 统一调用多种文档解析模型LlamaIndex:产品、工程与评测
- Perplexity 开源 pplx-embed-v2-late 多模态 late-interaction 嵌入模型(9B 与 0.6B)Aravind Srinivas
- Unsloth 开源教程:本地训练 Qwen3.5 0.8B 决策模型,准确率从 20.7% 提升至 74.3%Unsloth
- vLLM 详解 DeepSeek-V4.1-Flash 优化:Agent 场景吞吐提升 5 倍vLLM 官方博客
- LangChain 重构 Deep Agents 的 Skills 支持,新增工具绑定、固定技能与线程内重载LangChain:Blog
- Liquid AI 发布开源决策模型 d1-3B 和 d1-omni-600MLiquid AI 模型与工程博客跟进
- Stanford HAI 研究:想让员工拥抱 AI,别把它包装成效率工具Stanford HAI News
- Google 发布 Developer Knowledge API 生态,为 AI 智能体提供官方文档检索Google Developers Blog
- PromptArmor 解析 WebMCP 的机制与主要安全风险PromptArmor:Threat Intelligence