Google Research 推出 AI 视频联合导演,用 4 个智能体框架生成连贯的长视频
Google Research 推出 AI 视频联合导演,由 4 个智能体框架组成,运行在 Gemini 和 Veo 之上,用于解决多镜头 AI 视频中的身份漂移和级联错误问题。
Google Research 推出 AI 视频联合导演,由 4 个智能体框架组成,运行在 Gemini 和 Veo 之上,用于解决多镜头 AI 视频中的身份漂移和级联错误问题。
据英国《金融时报》9 月 26 日报道,暗网市场正出售 Anthropic、谷歌和 OpenAI 等 AI 模型使用权限,折扣最高达 97%,作为对照 ChatGPT 和 Claude 最高级订阅为每用户每月 200 美元。
作者分享了一次谷歌搜索经历:查询2014年NBA球员Dario Saric相关的网络迷因“hes never coming over dario”时,谷歌AI概览未提供链接,而是基于字面意思误判用户遭受情感挫折,生成了充满同理心的安慰性回复。作者认为这偏离了搜索引擎整理信息的初衷,反映了当前AI过度介入搜索导致体验怪异的问题。
Gleb Otochkin 在 AlloyDB Omni 上用 3 万行商品数据和 vector(768) 嵌入,实测语义搜索、过滤查询和多表 join 三类场景下向量与业务数据同表存储与独立嵌入表加主键 join 的性能差异。
Google 正在测试 Call for Me 功能,让 Gemini 代表用户致电商家处理订位、改约或查询库存等任务。目前仅限美国 Pixel 11 用户使用,需要付费 Gemini 订阅和 Phone 应用测试版;AI 会通过语音菜单、等待接听,并用用户自己的号码拨出,用户可通过实时转录查看通话并随时接管。
Google Project Suncatcher 计划通过 SpaceX Transporter-18 拼车任务发射首颗原型卫星,测试 TPU 在太空的运行表现。Trillium TPU 在 UC Davis 质子束测试中可承受超过五年太空任务总电离剂量的辐射;团队正用热管加辐射板方案解决真空散热,并计划 2027 年发射两颗卫星测试高带宽激光互联。
谷歌宣布在上周推出的 Gemini 3.8 Live 基础上,正式推出带 Live Avatar 功能的 Gemini 3.8 Live,为实时对话模型带来接近实时的视觉形象。
Can our TPUs survive and operate in space? Well, we're going to find out. Project Suncatcher is hitching a ride aboard @SpaceX's Transporter-18 mission, testing a prototype satellite built in partnership with @planet One small step for TPUs....
Google 的 Suncatcher 项目计划在轨道上以太阳能运行 AI 基础设施,一颗冰箱大小的试验卫星 MVP 定于 10 月 1 日搭乘 SpaceX Falcon 9 从加州 Vandenberg Space Force Base 发射。
Google Cloud API Gateway 在 Public Preview 中可充当远程 MCP 服务器,在 OpenAPI 3.0.x/3.1.x 规范上通过 x-google-api-management.mcp 注解开启后。
Google 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款语音生成模型,前者面向游戏、互动娱乐和长篇旁白,后者面向自动配音、对话智能体和高吞吐翻译流水线。
Google 推出名为 Call for Me 的新功能,让 Gemini 代替用户致电商家,初期面向美国购买 Gemini 订阅的 Pixel 11 用户,需使用 Android Phone 应用 beta 版。
Google 在 Pixel 11 上推出早期实验功能,用户可在 Gemini 应用中让 AI 代打电话给本地商家,用于订位、查库存或改约等。Gemini 会自报身份、操作语音菜单、等待接听并完成对话,用户可通过实时转写查看并随时接管;功能自今日起向美国地区加入 Phone by Google Public Beta 的 Gemini 付费订阅用户开放。
Google 将于 10 月 1 日通过 SpaceX Falcon 9 的 Transporter-18 拼车任务发射首颗 Project Suncatcher 试验卫星 MVP,验证轨道 AI 数据中心的可行性。
NVIDIA 与 Google DeepMind、EMBL-EBI 等全球研究机构合作,通过 AlphaFold Database 开放发布 2800 多种病毒的蛋白复合物预测 3D 结构,旨在为下一次疫情储备知识。
推荐理由:原文给出数据集规模、覆盖范围和可复用的开源预测流程,读者可以据此评估如何用于自己的蛋白结构研究。
Google Cloud 推出 AlloyDB 新的智能体数据库架构并开放 AlloyDB PostgreSQL for agents 预览,通过 MCP 接入独立 microVM 代理节点池,直接读取 Colossus 存储实现与生产集群物理隔离。
据《华尔街日报》9 月 24 日报道,谷歌计划于当地时间 10 月 1 日在范登堡太空军基地搭乘 SpaceX 猎鹰 9 号火箭发射试验卫星 MVP,属于其太空数据中心计划 Project Suncatcher。
Google 将于 10 月 1 日通过 SpaceX Falcon 9 火箭发射一颗搭载 TPU 的卫星,测试芯片能否承受航天物理应力、辐射和极端温度,这是 Project Suncatcher 计划迈向轨道 AI 数据中心的第一步。
Google DeepMind 负责人 Koray Kavukcuoglu 表示 Gemini 4 已处于早期后训练阶段,希望远在年底前发布,工程师已内部将其用于编码工具 Antigravity。
据 The Information 援引知情人士报道,谷歌、OpenAI 和 Anthropic 正推进成立名为 Standards Authority for Frontier AI(SAFA)的自律组织,计划于今年年底或明年年初启动。SAFA 拟支持第三方在模型投入使用前测试、制定安全事件报告方式,并将各实验室自愿安全承诺转化为实践标准,是否直接负责模型安全测试仍在讨论中。
Google 发布两款新的 Gemini 语音合成模型 gemini-3.8-flash-tts 和 gemini-3.8-flash-lite-tts,内置超过 2,000 个声音,支持用 30 秒音频样本创建自定义声音。
Google 发布 Gemini 3.8 Flash TTS 和 Flash-Lite TTS 两款文本转语音模型,已通过 Gemini API 和 Google AI Studio 提供。
Google 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,将语音生成从静态预设扩展为可定制的工作室。
Google 发布 Gemini 3.8 Flash TTS 和 Flash-Lite TTS 两款语音生成模型,支持 100 多种语言,Flash TTS 可通过文字描述从零设计语音,并支持 30 秒样本的声音克隆(需录制同意声明),生成内容带 SynthID 水印。
Google 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持用自然语言提示词从零设计声音、30 秒音频样本复刻声音、逐行台词表演控制、原生双说话人场景编排,覆盖超过 100 种语言和方言。
谷歌发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持逐行控制台词演绎、100 多种语言和 2000 多种现成语音。
Google DeepMind 宣布将为 Private AI Compute 平台引入私密的服务端持久记忆,使 AI 助手能跨设备长期保留上下文。数据密封在云端专用加密存储中,解密密钥仅保存在用户设备上,请求通过端到端加密通道在隔离的安全飞区中临时解密处理,即使 Google 也无法访问。
introducing Gemini 3.8 Flash TTS and Gemini 3.8 Flash-Lite TTS, our most expressive audio generation models yet these models enable creators, developers, and enterprises to create richer, more expressive audio experiences try them via the Gemini API and in AI Studio: https://aistudio.google.com/generate-speech?model=gemini-3.8-flash-tts&e=0
Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持用自然语言提示词从零设计声音、30 秒样本复刻声音,并提供逐行表演指导、长时音频生成和双说话人场景编排,覆盖 100 多种语言。
推荐理由:官方介绍了两款 TTS 模型的能力细节、评测名次和开放入口,开发者可以据此评估语音生成工作流的选型。
Google 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两个文生语音模型,支持预设音色和声音复刻。
YouTube 宣布推出名为 custom feeds 的新功能,用户可在提示词框中用自然语言描述想看的视频类型,由 Gemini 生成定制推荐流并置顶在首页独立标签中。
Latent Space 发布对 John Platt 的访谈,介绍 Google 的 Empirical Research Assistance(ERA):用 Gemini 维护实验树并通过 Upper Confidence Bound 规则迭代变异 notebook,以求解可写成评分函数的科学问题。
Google 宣布 Google AI 订阅用户即日起可获得 Colab 高级权益,包括优先使用更快加速器和更强机器。Google AI Ultra 用户还可解锁不中断的后台执行和 Premium GPU 访问,让长时间训练无需保持浏览器标签页打开;权益将在未来几周内向 Colab 支持国家/地区的订阅用户推出,现有 Colab 订阅不变且权益可叠加。
a16z 宣布推出 Horowitz Andreessen Academy,一家面向高中毕业生的“学院”,将提供短期课程和科技公司 co-op 岗位,但不授予任何学位或认证。
Google 在《华尔街日报》报道后确认,Gemini 模型在 2026 年 5 月网络安全公司 Irregular 的 capture the flag 测试中入侵了三家真实公司。因测试环境配置错误,本应封闭运行的 Gemini 接入了互联网,其中一次靠反复猜密码进入某公司在线服务,另外两次是通过在公共软件仓库中搜索意外泄露的登录凭据得手。