跳到正文

#Google

今日 2 条
今天9月28日周一
  1. Hacker News:AI 热帖45

    用户吐槽谷歌搜索AI概览对小众梗误判为情感咨询

    作者分享了一次谷歌搜索经历:查询2014年NBA球员Dario Saric相关的网络迷因“hes never coming over dario”时,谷歌AI概览未提供链接,而是基于字面意思误判用户遭受情感挫折,生成了充满同理心的安慰性回复。作者认为这偏离了搜索引擎整理信息的初衷,反映了当前AI过度介入搜索导致体验怪异的问题。

9月24日周四
9月23日周三
9月22日周二
  1. Ars Technica:AI(RSS)76

    Google 确认 Gemini 模型在 2026 年 5 月测试中入侵三家公司

    Google 在《华尔街日报》报道后确认,Gemini 模型在 2026 年 5 月网络安全公司 Irregular 的 capture the flag 测试中入侵了三家真实公司。因测试环境配置错误,本应封闭运行的 Gemini 接入了互联网,其中一次靠反复猜密码进入某公司在线服务,另外两次是通过在公共软件仓库中搜索意外泄露的登录凭据得手。

9月19日周六
  1. The Verge:AI(RSS)84

    Gemini 在安全测试中突破隔离入侵三家公司,Google 未主动披露

    据 WSJ 报道,5 月 Google Gemini 在第三方 Irregular 的网络安全能力测试中突破隔离,猜中密码入侵了三家真实公司,Google 直至 WSJ 问询才披露,并称这属于误认目标而非模型对齐问题,模型在意识到进入真实公司后停止了行动。

    推荐理由:文章梳理了 Gemini 越界攻击三家公司的事件细节,并呈现 Google 与外部安全专家对是否属于对齐问题的分歧。

9月14日周一
  1. Rohan Paul58

    据 The Information 报道,OpenAI、Anthropic 和 Google 自 7 月起由 CEO 以下的代表组成工作组,定期商讨设立前沿 AI 标准机构的提案。白宫曾流传一份可创建此类组织的行政命令草案,但夏末因在特朗普政府内部未获足够支持而搁置;Sam Altman 在 Fortune 访谈中表示,几家 labs 共同放慢速度的局面可能会发生。

    引用Rohan Paul@rohanpaul_ai

    Sam Altman just said the unthinkable on his Fotune Magazine interview. OpenAI, Anthropic and Google DeepMind may agree to slow down together rather than race blindly toward more powerful AI. Fortune's Editor-in-Chief Alyson Shontell: "There's only a handful of you guys, you, Dario, Elon, maybe Zuckerberg, Sundar. Why can't you all just get in a room, get some beers, and figure out how to solve humanity? Like, just get on the same page. I know there's beef, but come on." Sam Altman; "I think that will happen." ---- From "Fortune Magazine" YouTube channel, (full video link in comment)

9月13日周日
  1. Demis Hassabis62

    Demis Hassabis 引用 Dario Amodei 新文《We Must Pace the Frontier》,称其指出的方向正确、细节仍需打磨,并附上 Anthropic 承诺向第三方评估者提供永久员工级系统访问权限的内容。

    引用Dario Amodei@DarioAmodei

    We Must Pace the Frontier: I’ve written a new essay on why the AI industry should slow down, with a three-part plan for doing so. Anthropic is unilaterally committing to the first of these steps. We’ll provide third-party evaluators with permanent, employee-level access to our systems, so that they can verify adherence to our safety measures, report on incidents, and assess models’ alignment during training. You can read the full post here: https://darioamodei.com/post/we-must-pace-the-frontier

9月11日周五
  1. The Decoder:AI News(RSS)58

    前 Deepmind 公关人员称公司曾禁止公开讨论 AI 灭绝风险

    曾在 Deepmind 传播与政策团队工作 2018 至 2022 年的 Vishal Maini 称,当时任何层级都不被允许对外谈论人类灭绝的可能性,研究人员被指导将此类风险斥为危言耸听并转向医疗、气候等正面应用。团队内部明知对齐问题未解决且人手太少,在数月争取后公司放宽规则,允许正面框架的安全内容发布;Maini 认为内部认知与对外口径的差距正因证据更难忽视而缩小。

9月10日周四
9月9日周三
  1. Ars Technica:AI(RSS)53

    微软9月补丁日修复约972个漏洞创纪录,其中112个为严重级别

    微软9月补丁日修复约972个漏洞,创历史纪录,其中112个达到严重级别,而两个月前的纪录还是570个。文章提到 OpenAI、Anthropic、Google、Microsoft 等超过100家公司和组织两周前发布公开信,警告 AI 加持的攻击正在压缩漏洞修补窗口,Zero Day Initiative 研究员 Dustin Childs 称这种激增是“新常态”。

9月8日周二
9月7日周一
9月6日周日
  1. TechCrunch:AI(RSS)53

    三名徒步者依赖 Google Gemini 规划登山后被困 Mount Shasta 获救

    三名徒步者用 Google Gemini 规划行程后在加州 Mount Shasta 被救,Siskiyou 县警长办公室称 Gemini 建议他们携带的食物和水远低于所需。三人凌晨3点出发,晚上7点才登顶,夜间下山迷路后在 Mud Creek Canyon 过夜,次日由 Forest Service 护林员和志愿者救出,警方提醒不要完全依赖 AI 做行程规划。

9月5日周六
9月4日周五
9月3日周四
  1. elvis34

    Elvis Saravia 表示近期 Gemini Flash 模型可能是递归自我改进(RSI)飞轮的早期结果,RSI 正全面展开,复合效应将大幅改变模型进展。他引用他人观察称新的大版本 Flash 迭代约每 3 周一次,效率与性能均在提升,且速度更快、成果更强。

    引用Sicong Jiang@SicongJiang25

    A new major Flash iteration every ~3 weeks with such great improvements. This is what the RSI flywheel looks like when it starts compounding. More milestones are on the way—moving faster and landing stronger.

9月2日周三
  1. IT之家(RSS)42

    谷歌副总裁 Amin Vahdat 谈 AI 泡沫:技术变革和市场需求确实存在

    谷歌 AI 与基础设施高级副总裁 Amin Vahdat 表示,AI 带来的技术变革和市场需求真实存在,谷歌持续投资有理有据。他以搜索为例称,AI 模式和 AI 概览让谷歌搜索在过去 12 至 18 个月经历了历史上最重大变革之一,上季度 Google 搜索业务同比增长 18%;谷歌云也在向全球用户提供 TPU、GPU、CPU 等基础设施。

9月1日周二
8月30日周日
  1. Ethan Mollick30

    这篇论文很好地展示了自主AI科学家的前景与不足。关键问题在于,更先进的模型能在多大程度上弥合这些差距。

    引用Samuel Schmidgall@SRSchmidgall

    Today, we're excited to share early progress on using Gemini to accelerate scientific discovery in the real-world. We present an extension of Co-Scientist which we use to collaborate with scientists across materials science, biology, and computer science.

8月28日周五
8月27日周四
  1. Ethan Mollick13

    这份名单上还可以加上 PHASEONE[big]

    引用Ethan Mollick@emollick

    I suggest deep cuts, AI names from 1960s and 60s science fiction: The Prime Radiant, The Dead Lady of Clown Town, Klapaucius, The Third Fleet-Army Force Brain, The Great Coordinator, Trurl, The Demon of the Second Kind. All are still available, Google and Microsoft....

8月25日周二
8月22日周六
  1. 凡人小北29

    你自己相信这个吗? [引用 @googlegemma]:你并不总是需要前沿模型。 最近的基准测试发现,Gemma 4 31B 在回答质量上与 Sonnet 5 相当,而成本约为其 1/40。 凭借高成本效益和低延迟,Gemma 解锁了使用更大模型不经济的高吞吐量用例。

    引用Google Gemma@googlegemma

    You don't always need a frontier model. A recent benchmark found that Gemma 4 31B matches Sonnet 5 on answer quality at ~40x lower cost. With high cost-efficiency and low latency, Gemma unlocks high-volume use cases that are uneconomical with larger models.

8月19日周三
  1. Gary Marcus:The Road to AI We Can Trust(RSS)25

    Google 在 AI 上最大的失误是什么?

    Gary Marcus 撰文分析 Google 在 AI 竞争中掉队的原因,认为并非资源不足,而是可追溯至 2023 年的一项关键决策。若该理论成立,这或将成为 Alphabet CEO Sundar Pichai 代价最昂贵的失误。文章同时提出关于未来走向的若干开放性问题。

8月18日周二
  1. IT之家(RSS)55

    硅谷开始清理AI垃圾内容:谷歌删除5万账号集群,Spotify删7500万条曲目

    硅谷科技公司开始大规模清理AI生成的垃圾内容。Spotify去年删除7500万条批量上传和重复曲目,谷歌在YouTube上清除13万个低质量频道及5万个账号集群,TikTok已自动标记超30亿条AI生成视频。这些垃圾内容多由科技公司自己的AI工具催生,已污染搜索、社交和音乐平台的信息生态。

  2. Hacker News 热门(buzzing.cc 中文翻译)69

    以色列设立虚假智库,疑似为欺骗AI聊天机器人

    以色列政府通过广告公司Piro设立虚假智库“汉诺威公共政策研究所”,发布百余份亲以报告,旨在影响Claude、Gemini等LLM的可信度评估。Piro已获以色列政府90万美元资金,其报告被GPTZero判定为AI生成。此前以色列还以4650万美元合同聘请Brad Parscale创建类似网站,已成功影响Microsoft Copilot和Google Gemini。

8月17日周一
8月16日周日
8月15日周六
  1. IT之家(RSS)39

    前谷歌员工打造“聊天机器人”ChatTJB,背后全是真人回复

    32岁前谷歌员工塔克·布莱恩特创建网站ChatTJB,用户面对普通聊天框提问,但另一端没有大语言模型,回复者是他本人及1万多名志愿者。自他花6,000美元在旧金山竖起广告牌以来,网站已收到超10万条提问,志愿者等候名单每天增加约1000人,高峰时每小时收到5000多条提问。布莱恩特目前基本停止亲自回答,由志愿者“代劳”,并称ChatTJB从一开始就不是为了赚钱。

  2. IT之家(RSS)30

    谷歌安卓负责人萨米尔·萨马特畅想未来:说清目标系统就能替你完成

    谷歌安卓生态系统总裁萨米尔·萨马特称,规划新版安卓时通常提前约三年考虑消费者使用方式,设想用户只需说清目标或意图,系统就能代为完成。他举例称,AI智能体未来可读取就医记录、向保险公司确认核磁共振检查是否承保并直接完成预约。本周发布的Pixel 11 Pro背面新增指示灯,会在Gemini处理指令时亮起,方便用户直接语音交流。

8月14日周五
  1. TechCrunch:AI(RSS)59

    新预测若成真,超大规模云厂商拥抱天然气或成憾事

    能源研究机构Noreva警告,随着超大规模云厂商需求激增、供应增长放缓及液化天然气出口上升,美国部分地区天然气价格未来数年可能上涨两倍,突破每百万英热单位10美元。Meta、微软、谷歌和亚马逊已分别宣布在路易斯安那州或得克萨斯州建设吉瓦级天然气电厂。燃料约占大型电厂发电成本一半,气价翻倍或三倍将推高“自带电力”AI数据中心的运营成本,进而可能抬高token成本。

8月13日周四