Topic · 主题全部主题 →

Google / Gemini

Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。

2,213条收录
296条精选

精选归档 · 第 6 页

101120 条 · 共 296

6月17日6月17日周三

星期三 · 1 条
23:32
Google Blog:AI(RSS)精选
AI 评分 55/100
Google 医学推理 AI 系统 AMIE 新研究:从诊断迈向长期疾病管理

今日发表在《自然》杂志上的研究展示了 Google 的医学推理 AI 系统 AMIE(Articulate Medical Intelligence Explorer)从单次诊断对话演进到长期疾病管理的能力。AMIE 利用 Gemini 模型的长上下文能力,整合共情对话智能体和深度思考管理推理智能体,可交叉引用数百页临床指南。在盲测中,AMIE 与 21 名初级保健医生相比,在整体管理推理上匹配临床医生,在计划精确性和指南一致性上得分显著更高。


推荐理由:Google 把医疗 AI 从一次诊断推到了长期疾病管理,Nature 上的对照实验显示它在计划精确性上甚至优于初级保健医生,做数字健康的人值得认真读一下。

6月16日6月16日周二

星期二 · 2 条
16:40
MarkTechPost(RSS)精选
AI 评分 71/100
Google Cloud 推出 OKF v0.1:供应商中立的 Markdown 规范,为 AI 智能体提供结构化上下文

Google Cloud 发布 Open Knowledge Format (OKF) v0.1,一种供应商中立的 Markdown 规范,为 AI 智能体提供结构化上下文知识。OKF 将知识表示为带 YAML 前置元数据的 markdown 文件目录,每个概念对应一个文件,通过 typetitledescription 等少量保留字段实现互操作。无需专有服务、SDK 或运行时,目录可托管在 GitHub、以 tarball 传输或挂载到任意文件系统。OKF 旨在解决组织内部知识碎片化问题——表结构、指标定义、runbook 等散落在不同 catalog 和 wiki 中,各厂商方案互不兼容。遵循最少意见原则,只强制 type 字段,生产者和消费者可独立实现。使用场景包括数据团队将 BigQuery 表定义导出为代码、为智能体存储 incident runbook、跨组织知识交换等。


推荐理由:这是 Karpathy LLM Wiki 思想的首个工业级标准化尝试,把散落在各处的内部知识统一成 agent 可读的 markdown 规范,对构建 AI 应用的团队是切实的工程改进,值得加入设计检查清单。
01:00
Google Cloud:Databases(RSS)精选
AI 评分 61/100
Google Cloud 发布多项 Data Agent 新工具,助力 AI 工作流

Google Cloud 发布一系列 Data Agent 新工具,帮助开发者利用企业数据构建 AI 智能体。新功能包括 BigQuery 中 Conversational Analytics 的扩展支持、已正式上线的 Data Engineering Agent,以及预览版的 Database Observability Agent。


推荐理由:Google Cloud 一口气发布多个数据代理,覆盖从运维到 BI 的全流程,自家生态的数据工程师应该看看,但对不依赖 GCP 的团队意义有限。

6月13日6月13日周六

星期六 · 2 条
17:36
IT之家(RSS)精选
AI 评分 80/100
谷歌Android安全负责人因反对军事AI合作辞职

谷歌Android平台安全负责人René Mayrhofer辞职,他在5月18日内部告别信中指责公司“丧失道德指针”,批评谷歌悄悄放弃碳中和目标(因AI模型能耗),并与美国战争部签署允许AI用于“任何合法目的”的协议。今年4月下旬谷歌宣布向五角大楼提供AI用于机密工作,2025年2月更新AI原则时移除了不使用AI开发武器或监控工具的承诺。Mayrhofer担忧谷歌AI产品可能被用于针对公民的大规模监控,包括自己和家人。


推荐理由:Android 安全主管因军事 AI 合作愤而辞职,并公开内部告别信,这是谷歌放弃不作恶后最响亮的内部抗议,暴露了 AI 伦理与商业利益的深层冲突。
02:23
TechCrunch:AI(RSS)精选
AI 评分 74/100
Google 起诉被指使用 AI 发送诈骗短信的中国网络犯罪团伙"Outsider Enterprise"

Google 起诉一个名为“Outsider Enterprise”的组织,指控其利用人工智能在两周内发送了 250 万条诈骗短信,导致数十万受害者上当。该组织被描述为中国网络犯罪团伙。

另有 1 家信源报道TechCrunch:AI(RSS)
推荐理由:谷歌起诉利用AI进行诈骗的中国犯罪团伙,披露细节和19亿美元损失规模让人震惊,这标志着AI滥用从实验走向产业化,所有AI工具厂商都该看看起诉书,思考如何防止平台被武器化。

6月12日6月12日周五

星期五 · 2 条
01:20
Logan Kilpatrick@OfficialLoganK精选
AI 评分 81/100
Gemini Omni Flash 视频任务达 SOTAGemini Omni Flash is SOTA at image to video, text to video, and video editing : )Excited to get this to developers in the API soon!Gemini Omni Flash 在图像到视频、文本到视频和视频编辑方面达到了 SATA : ) 很高兴很快能将这一能力通过 API 提供给开发者!

推荐理由:视频生成正式进入全模态一体时代,Gemini Omni Flash 把图生视频、文生视频和剪辑整合在一个模型里,API 很快上线,做视频工具的可以提前琢磨对手在哪了。

6月11日6月11日周四

星期四 · 7 条
19:42
Google DeepMind:Blog(RSS)精选
AI 评分 60/100
Google DeepMind 宣布投入 1000 万美元资助多智能体AI安全研究

Google DeepMind 与合作伙伴共同发起一项 1000 万美元的资金征集,专门用于多智能体 AI 安全方向的研究。


推荐理由:DeepMind 联合 Schmidt Sciences 等发起千万美元级多智能体安全研究资助,标志着对大规模 agent 交互中深层风险的正式关注,做 agent 安全的人可重点关注。
04:29
OpenRouter:Announcements(RSS)精选
AI 评分 64/100
Gemini 2.5 Flash API - 定价、快速入门与提供商比较

Gemini 2.5 Flash API 支持配置思考预算(thinking budgets),用户可跨提供商进行比较,并在5分钟内完成首次API调用。


推荐理由:这是 OpenRouter 上接入 Gemini 2.5 Flash 的保姆级指南,把三家 Google 提供商的延迟和定价差异摆在明面上,需要做模型选型和成本估算的开发者可以直接抄里面的 quickstart 代码。
02:46
Google Research:Blog(网页)精选
AI 评分 63/100
Google Research提出审计机器遗忘新框架

Google Research 在 AISTATS 2026 发表正则化 f-散度核检验,用于高效审计 LLM 等模型的机器遗忘。该方法通过统计两样本检验判断模型是否真正“忘记”特定训练数据,避免完全重训的巨大成本。相比最大均值差异等现有工具,新框架理论上可在任意样本量下自然控制假阳性,且假阴性风险随可用样本增加可靠收敛至零,解决了大规模模型审计中计算成本过高的问题。


推荐理由:机器遗忘是AI合规的硬需求,但验证‘真忘了’一直是统计难题。谷歌这篇AISTATS论文提出了一套更灵敏的差异测试框架,做隐私审计的值得细看。
01:44
Gary Marcus:The Road to AI We Can Trust(RSS)精选
AI 评分 73/100
突发:Google 因模型幻觉被判负有法律责任

一项法律裁决判定 Google 对其 AI 模型产生的幻觉内容负有法律责任。该判决可能产生巨大影响,尤其若其他国家跟进做出类似裁定。

另有 1 家信源报道Hacker News 热门(buzzing.cc 中文翻译)
推荐理由:Google 因 AI 幻觉被追责,这个判例如果扩散,所有生成式 AI 产品都要重新审视风险,对行业是重大信号。
00:40
Google DeepMind:Blog(RSS)精选
AI 评分 72/100
DiffusionGemma:文本生成速度提升4倍的开源扩散模型

Google DeepMind 发布开源实验模型 DiffusionGemma,采用文本扩散技术,突破自回归逐 token 生成方式,每次前向并行生成 256 个 token。该 26B MoE 模型推理时仅激活 3.8B 参数,量化后适配 18GB 显存消费级 GPU。在 H100 上达 1000+ tokens/s,RTX 5090 上 700+ tokens/s,速度提升 4 倍。具备双向注意力和自我修正能力,面向内联编辑、代码填充等本地交互工作流,以 Apache 2.0 许可证开放。

另有 6 家信源报道X:Google AI for Developers (@googleaidevs)Google Developers Blog(RSS)X:Demis Hassabis (@demishassabis)X:Google DeepMind (@GoogleDeepMind)X:Testing Catalog (@testingcatalog)MarkTechPost(RSS)
推荐理由:DiffusionGemma 虽为实验性质,但它把文本生成从“串行打字机”变成了“并行印刷机”,本地推理速度 4 倍提升,对需要实时交互的开发者是个值得关注的方向。
00:19
The Verge:AI(RSS)精选
AI 评分 74/100
Google将保存用户的Lens图片、Search Live录音和Translate音频用于AI训练

Google更新搜索交互数据保存方式,新增“Search Services History”设置,用于保存用户搜索时使用的图片、文件、音频和视频,包括Google Lens搜索的图片、实时搜索工具Search Live的录音、语音搜索和Translate中的语音片段。这些数据将被用于“提供、改进和开发AI模型”。用户可关闭该设置并禁用“Save Media”选项以避免保存。


推荐理由:Google这回悄悄把图片、录音存下来训练AI,默认开启,虽然可以关,但灰度操作值得每个用搜索的人看一眼。

6月10日6月10日周三

星期三 · 5 条
17:28
IT之家(RSS)精选
AI 评分 70/100
谷歌 DeepMind 经济学家伊马斯:尚未发现 AI 造成岗位流失的证据,跟风裁员恐适得其反

谷歌 DeepMind AGI 经济学负责人亚历克斯·伊马斯表示,目前没有看到白领岗位因 AI 大规模消失的证据。他强调,若企业因“不裁员就等于 AI 转型慢”的叙事而跟风裁员,可能适得其反。伊马斯认为,AI 更多是接手部分任务、提升生产力,让员工专注机器无法完成的工作,岗位冲击尚未真正出现。

另有 1 家信源报道IT之家(RSS)
推荐理由:来自AI核心阵营的经济学家说‘还没证据’,这本身就值得每个担心被AI替代的人看一眼,那种‘没裁员就是落后’的FOMO叙事可能更危险。
01:51
Jeff Dean@JeffDean精选
AI 评分 81/100
Gemini 3.5 Live Translate 支持70+语言翻译Speech translation has been one of the longest-running ML efforts at Google, and we’ve come a long way. Gemini 3.5 Live Translate is our latest speech-to-speech model, supporting 70+ languages. It enables more natural conversations across languages in everyday products and apps.Here’s an example of how partners at @InsideGrab are helping connect travelers with drivers. 🚗Rolling out in Google Translate and via the Live API in @GoogleAIStudio.语音翻译一直是Google历时最久的机器学习项目之一,我们已经取得了长足进展。Gemini 3.5 Live Translate是我们最新的语音到语音模型,支持70多种语言。它能让日常产品和应用中跨语言的对话更加自然。 以下是一个示例,展示@InsideGrab的合作伙伴如何帮助旅客与司机建立联系。🚗 已在Google Translate和@GoogleAIStudio的Live API中推出。
另有 17 家信源报道X:Ethan Mollick (@emollick)X:Google AI for Developers (@googleaidevs)X:Gemini (@GeminiApp)X:Logan Kilpatrick (@OfficialLoganK)X:Google AI (@GoogleAI)Google DeepMind:Blog(RSS)Google Blog:AI(RSS)Google Developers Blog(RSS)Hacker News 热门(buzzing.cc 中文翻译)IT之家(RSS)X:阿易 AI Notes (@AYi_AInotes)X:Google DeepMind (@GoogleDeepMind)The Verge:AI(RSS)X:Kim (@kimmonismus)X:Rohan Paul (@rohanpaul_ai)The Decoder:AI News(RSS)X:Sundar Pichai (@sundarpichai)
推荐理由:Google把语音翻译做到70+语言,Gemini 3.5 Live Translate直接塞进Google Translate和API,普通人下载App就能用,做跨国生意的这下有福了。
00:15
The Decoder:AI News(RSS)精选
AI 评分 77/100
里程碑式德国裁决:Google AI Overviews 被视为谷歌自身言论,需为错误回答承担责任

德国地方法院裁定,Google 对其 AI 概览生成的内容直接承担法律责任,不能援引搜索引擎运营商原有的有限责任保护。涉案 AI 概览错误地将两家出版商与欺诈行为关联,且相关声明未出现在任何链接来源中。该裁决可能为全球 AI 生成内容责任认定树立先例。


推荐理由:德国法院这一刀砍得精准,直接把 AI Overviews 定性为 Google 自己的话而非第三方内容,虚假回答就得自己扛。这对全球 AI 生成内容的责任认定都是个风向标。
00:00
OpenRouter:Announcements(RSS)精选
AI 评分 60/100
Gemini 2.5 Flash API:定价、快速入门与提供商对比

Gemini 2.5 Flash API 的定价与快速入门指南,指导用户配置 thinking budgets、比较不同提供商,并在 5 分钟内完成首次 API 调用。


推荐理由:Gemini 2.5 Flash 最值得关注的是 thinking budget,这篇教程把怎么用、怎么省都讲清楚了,但对早已熟悉文档的开发者来说新东西有限。

6月9日6月9日周二

星期二 · 1 条
23:35
Google DeepMind@GoogleDeepMind精选
AI 评分 69/100
Gemini 3.5 Live Translate 发布Say hello, hola, 你好 to Gemini 3.5 Live Translate: our latest audio model built for fast, cross-language communication. 🌐说 hello, hola, 你好--欢迎 Gemini 3.5 Live Translate:我们最新的音频模型,专为快速跨语言交流而构建。🌐
另有 17 家信源报道X:Ethan Mollick (@emollick)X:Google AI for Developers (@googleaidevs)X:Gemini (@GeminiApp)X:Logan Kilpatrick (@OfficialLoganK)X:Google AI (@GoogleAI)Google DeepMind:Blog(RSS)Google Blog:AI(RSS)Google Developers Blog(RSS)Hacker News 热门(buzzing.cc 中文翻译)IT之家(RSS)X:阿易 AI Notes (@AYi_AInotes)X:Google DeepMind (@GoogleDeepMind)The Verge:AI(RSS)X:Kim (@kimmonismus)X:Rohan Paul (@rohanpaul_ai)The Decoder:AI News(RSS)X:Sundar Pichai (@sundarpichai)
推荐理由:Google 这个实时翻译模型把语音+翻译+大模型拧成了一股绳,虽然具体怎么用还不清楚,但做跨境、做语音助手的同学可以把它当个方向标。