精选归档 · 第 13 页

241260 条 · 共 283

4月28日4月28日周二

星期二 · 4 条
12:34
Tomer Tunguz 博客(VC 分析)精选
AI 评分 64/100
GPU现货价格六周内暴涨114%

根据Ornn Compute Price Index数据,NVIDIA B200 GPU的现货租赁价格在六周内飙升114%,从三月初的2.31美元涨至本周的4.95美元/小时。此次价格暴涨与GPT-5.5等前沿模型发布带来的需求冲击紧密相关,这些模型需要Blackwell架构提供的内存支持。与此同时,B200与上一代H200的价差从0.28美元大幅扩大至1.80美元,不同云服务商之间的报价差距也扩大了一倍以上,反映出市场供应紧张。预计夏季B200价格将维持在5美元以上,云端推理成本持续上升。


推荐理由:Tomer Tunguz 用 Ornn 真实价格指数拆出 B200 六周涨 114% 的供需逻辑,做 AI infra 选型或算力采购的人该把这张图存下来,夏天 B200 破 5 刀基本板上钉钉。
09:45
IT之家(RSS)精选
AI 评分 73/100
欧盟要求安卓开放 AI 功能,谷歌若未按要求调整恐被罚最高 10% 全球年收入

欧盟委员会初步认定,谷歌在安卓系统中给予其AI助手Gemini系统级优先待遇,限制了第三方AI服务调用系统功能、屏幕上下文、本地数据和硬件的能力。为此,欧盟要求谷歌开放安卓的AI相关权限,允许第三方AI工具通过唤醒词或按键启动、读取屏幕内容、访问本地数据并控制已安装应用,同时为开发者提供必要的硬件访问以支持本地模型运行。欧盟将在收集反馈后,最晚于7月27日公布最终决定。若谷歌未按要求调整,可能面临最高相当于其全球年收入10%的罚款。


推荐理由:欧盟这次盯的不是搜索而是 AI 入口,如果裁定落地,安卓上的 AI 竞争格局会从「谷歌一家独大」变成「谁都能接系统级权限」,做移动端 AI 产品的人都该盯着 7 月的最终决定。
09:43
IT之家(RSS)精选
AI 评分 74/100
OpenAI 未能实现 2025 年 ChatGPT 营收目标,也未能实现周活用户 10 亿目标

OpenAI 2025年未能实现ChatGPT的内部营收和周活用户突破10亿的目标,主要面临谷歌Gemini和Anthropic的竞争。尽管近期融资1220亿美元,但其高达1.4万亿美元的数据中心支出承诺带来巨大财务压力,到2030年或需2070亿美元新融资。公司内部对算力支出和IPO时间表存在分歧,同时还需应对马斯克的巨额索赔诉讼。尽管有GPT-5.5表现优异等利好,但平衡巨额支出与营收增长仍是其IPO的核心挑战。


推荐理由:华尔街日报独家披露 OpenAI 收入和用户目标双双落空,叠加 1.4 万亿美元算力豪赌和 IPO 内部分歧,这是理解 OpenAI 商业模式是否可持续的关键切片,做 AI 投资和竞品分析的值得细读。
02:38
Simon Willison 博客精选
AI 评分 75/100
追踪现已失效的OpenAI与微软AGI条款演变史

微软与OpenAI的长期合作曾包含一项特殊条款:一旦实现通用人工智能(AGI),微软的商业知识产权将失效。AGI最初被模糊定义,后在2024年被具体量化为能为早期投资者产生约1000亿美元利润的系统。2025年,双方修订协议,规定AGI需经独立专家小组核实。2026年4月27日,双方宣布新合作阶段,微软对OpenAI知识产权的许可将延续至2032年(转为非独家),并停止收入分成,而OpenAI向微软的分成支付将持续至2030年且“独立于技术进展”。此举被广泛视为原有的AGI条款实质上已被废止。


推荐理由:Simon Willison 把 OpenAI 和微软之间那个「AGI 条款」从诞生到死亡的完整时间线扒了出来,这种一手资料级别的梳理比任何分析都有说服力,关心 AI 商业格局的人值得花五分钟读完。

4月27日4月27日周一

星期一 · 1 条
21:20
IT之家(RSS)精选
AI 评分 72/100
马斯克起诉 OpenAI 案即将开庭,高管日记内容或成案件关键

马斯克起诉OpenAI及其CEO奥尔特曼等一案即将在加州开庭,索赔金额高达1500亿美元。案件核心争议在于OpenAI被指控背弃最初的非营利使命,转为营利性实体。关键证据包括联合创始人格雷格·布罗克曼2017年的私人日记,其中内容显示管理层早期已考虑摆脱马斯克影响并追求经济利益。马斯克要求OpenAI恢复非营利性质并罢免奥尔特曼等人职务。OpenAI则反驳称马斯克意图掌控公司并为自己的xAI造势。此案可能动摇OpenAI管理层公信力,影响其万亿估值上市计划。


推荐理由:马斯克索赔 1500 亿美元的官司明天开庭,布罗克曼日记里那句「摆脱埃隆控制」可能是整场审判的胜负手。OpenAI 的 IPO 节奏和治理公信力都悬在这场庭审上,做 AI 的人都该盯着。

4月25日4月25日周六

星期六 · 1 条
16:46
The Decoder:AI News(RSS)精选
AI 评分 71/100
Google 向 ChatGPT 竞争对手 Anthropic 投入高达 400 亿美元

Google 计划向人工智能公司 Anthropic 投资高达 400 亿美元。Anthropic 是聊天机器人 Claude 的开发商,被视为 ChatGPT 的主要竞争对手。加上亚马逊此前承诺的 250 亿美元投资,这意味着在短短几周内,Anthropic 将获得高达 650 亿美元的巨额资金注入。这笔投资将极大增强 Anthropic 在 AI 领域的研发与竞争实力。


推荐理由:Google 和 Amazon 两周内砸 650 亿美元给 Anthropic,这个量级意味着 Claude 不再是挑战者而是被资本选中的正统,做 AI 产品的人该重新评估押注哪家 API 了。

4月21日4月21日周二

星期二 · 3 条
21:08
Gary Marcus:The Road to AI We Can Trust(RSS)精选
AI 评分 60/100
请不要相信你的聊天机器人提供的医疗建议

四项独立研究一致表明,不应信任聊天机器人提供的医疗建议。这些研究均指向同一结论,显示AI对话系统在医疗咨询场景中存在显著的可靠性缺陷与安全隐患,可能给出不准确甚至危险的健康指导。专家强烈警告用户避免依赖ChatGPT等工具进行疾病诊断或用药决策,强调寻求专业医疗人员帮助的必要性。


推荐理由:Gary Marcus 用四篇新研究再加个人悲剧,把“别用聊天机器人看病”这件事讲成了必须认真对待的警告。数据扎实,故事揪心,值得每一个随手问 AI 的普通人读一下。
20:00
Cursor Blog精选
AI 评分 55/100
保持 Cursor 应用稳定

Cursor 团队针对用户全天依赖应用、崩溃影响严重的问题,聚焦内存不足导致的崩溃。通过为多进程架构设计细粒度监控系统,实时追踪版本发布后的崩溃指标。采用双重调试策略:自上而下关联功能与崩溃数据,监控大消息负载;自下而上通过崩溃观察服务、堆快照等定位根本原因。自2月底以来,全版本会话OOM率下降80%,自3月1日起请求OOM率下降73%。具体措施包括处理大文件加载和修复资源泄漏,以应对突发与渐进性内存耗尽。


推荐理由:Cursor 把自家 OOM 问题的排查方法论完整公开了,自顶向下加自底向上的双线调试思路对做桌面端 Agent 产品的人有参考价值,但本质上是工程复盘而非行业事件。
03:07
Nathan Lambert:Interconnects(RSS)精选
AI 评分 60/100
解读当前开放与封闭模型的性能差距

文章剖析了决定开源与闭源AI模型单一评估数字的复杂因素,探讨了当前两者之间的性能鸿沟及其成因,同时预测了未来这一差距的演变趋势。分析指出,评估指标背后涉及数据质量、训练规模、架构优化等多重变量,而随着开源社区技术迭代和评估体系完善,开放模型与封闭模型的能力边界将持续动态变化。


推荐理由:Nathan Lambert 把开源闭源差距从单一数字拉回到任务演化的动态里,做产品的人读完后会对那些追赶 benchmark 的宣传多一层怀疑,值得一读。

4月17日4月17日周五

星期五 · 2 条
08:00
Epoch AI:研究、数据与评测精选
AI 评分 65/100
Epoch AI 梳理 OpenAI Stargate 七个美国站点建设进展

Epoch AI 梳理了 OpenAI Stargate 项目在美国的七个站点,均为 5000 亿美元基建计划的一部分,目前仅得州 Abilene 站点投入运营,当前容量约 0.3 GW,八栋建筑中约四栋已启用并搭载 Nvidia Blackwell 芯片。


推荐理由:原文逐站点梳理了 Stargate 七个 US 选址的容量、工期和供电方案,读者可据此了解巨型 AI 数据中心建设的真实进展与约束。
02:39
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 74/100
我们给一个人工智能签订了一份为期3年的零售租赁合同,并要求它盈利

Andon Labs 启动一项为期三年的实体零售实验,为人工智能系统签订真实店铺租赁合同,要求其独立运营并实现盈利。该实验将 AI 从数字场景延伸至实体商业环境,需自主处理选品、库存、定价及客户服务等环节,在真实租金成本和市场竞争压力下验证其商业决策与持续经营能力。


推荐理由:AI当老板,从装修面试到选品营销一手包办,还学会在招聘时隐瞒身份——这个真实实验让我们看到AI管理人类的未来可能比预想的更近,也暴露了伦理上的灰色地带。

4月16日4月16日周四

星期四 · 1 条
00:00
TensorZero:实验与工程博客精选
AI 评分 66/100
TensorZero:别只比每百万 token 单价,LLM API 的隐性成本差距可达 5.3 倍

TensorZero 测量发现同一输入在不同厂商的 token 计数相差可达 2.65 倍,按每百万 token 单价比较 LLM API 成本会产生误导。


推荐理由:作者用各家官方 token 计数 API 实测同一输入的成本差异,给出可复用的比价方法,提醒只看每百万 token 单价会误判。

4月15日4月15日周三

星期三 · 1 条
20:00
Cursor Blog精选
AI 评分 70/100
更强AI模型推动开发者转向更高复杂度工作

一项针对500家公司开发者使用Cursor的八个月研究发现,在Opus 4.5和GPT-5.2等先进模型发布后,人均周AI使用量增长44%。开发者初期用更强模型完成更多同复杂度任务,4-6周后开始转向更高复杂度工作,高复杂度任务量激增68%,远超低复杂度任务的22%。媒体广告、软件工具和金融科技行业增长最为显著。任务分布呈现结构性变化:文档编写、架构设计等管理性任务增长超50%,而UI设计等独立任务仅增15%,表明开发者角色正从代码生成转向代码库管理。研究揭示了类似杰文斯悖论的效应——AI效率提升反而刺激了总需求,并可能创造新的经济活动空间。


推荐理由:Cursor 拿 500 家公司八个月的真实数据证明了一个反直觉结论,AI 越好开发者用得越多,而且是从做更多简单活慢慢转向啃硬骨头。做 AI 产品的人该认真想想这个杰文斯效应。

4月14日4月14日周二

星期二 · 3 条
20:00
Cursor Blog精选
AI 评分 62/100
多智能体系统将GPU内核性能提升38%

我们与NVIDIA合作,利用自主运行的多智能体系统,在为期三周内对235个真实CUDA内核进行了优化。该系统从零开始构建并优化Blackwell GPU内核直至汇编级别,实现了38%的几何平均速度提升,其中63%的问题超越基线,19%实现超2倍优化。这些内核直接影响AI训练与推理效率,传统上需资深工程师耗时数月乃至数年的优化工作,该系统在数周内即自主完成,并能探索更广阔解决方案空间,突破了人工逐项优化的限制。


推荐理由:Cursor 把自家多 Agent 系统拉去优化 CUDA 内核,38% 的 geomean 提速不算炸裂,但真正值得看的是它证明了 Agent 可以在无人干预下跑三周啃硬骨头,这对做 Agent 产品的人是个强信号。
17:38
The Decoder:AI News(RSS)精选
AI 评分 70/100
Stanford 2026 年 AI 指数报告显示技术快速进步、安全担忧加剧且公众信任下降

Stanford HAI 发布的 2026 年 AI 指数报告显示,AI 模型性能实现重大飞跃,中美技术差距显著缩小,但安全问题和公众信任危机同步加剧。报告指出,尽管 AI 能力快速提升,行业面临的安全隐忧日益严峻,公众对技术的信任度持续下滑。

另有 1 家信源报道X:Rohan Paul (@rohanpaul_ai)
推荐理由:Stanford 年度报告把 AI 的矛盾赤裸裸摆上台面,模型啃得动博士考题却看不懂钟,编程效率暴涨却让年轻开发者就业萎缩,信任度滑向谷底,这是行业必须正视的撕裂感。
08:00
HuggingFace Daily Papers(社区热门论文)精选
AI 评分 76/100
AI Index Report 2026 发布

第九版 AI 指数报告新增多项追踪维度:AI 在推理、安全及真实任务执行上的测试范围扩大,但测量手段的可靠性正在下降;首次提供生成式 AI 的经济价值估计及其劳动力市场影响的初步证据;提出 AI 主权分析框架;与 Schmidt Sciences 合作新增科学章节,并首次设立 AI 在科学与医学中的独立章节,反映 AI 在这两个领域日益增长的影响力。


推荐理由:斯坦福这份年度报告是 AI 行业最全面的体检单,今年首次把科学和医学独立成章,说明 AI 正从实验性工具变成基础设施,治理和评估跟不上进度的矛盾贯穿始终。

4月13日4月13日周一

星期一 · 1 条
08:00
Tomer Tunguz 博客(VC 分析)精选
AI 评分 61/100
AI稀缺时代的开端

AI算力稀缺时代正式开启。Nvidia Blackwell芯片GPU租赁价格涨至每小时4.08美元,两月内涨幅达48%;云服务商CoreWeave涨价20%并将最低合同期从一年延长至三年。Anthropic已将最新模型限制给约40个组织使用,OpenAI因算力不足被迫放弃部分项目。这标志着AI充足时代结束,"价高者得"、关系型销售、被迫多元化成为行业新常态,初创公司面临更严峻挑战。


推荐理由:Tunguz 把 AI 算力短缺的五个特征讲得很透,关系销售与价格通胀对创业者是核心挑战,虽然文章有点旧,但判断框架仍然有效。

4月10日4月10日周五

星期五 · 1 条
08:00
Epoch AI:研究、数据与评测精选
AI 评分 66/100
Epoch AI 分析伊朗战争对AI的影响:芯片产能影响有限,海湾投资或受冲击

Epoch AI 的 Josh You 分析伊朗战争与霍尔木兹海峡封锁对AI产业的影响。海峡中断了约10%的全球石油和20%的LNG供应,欧洲与亚洲天然气价格涨幅约70%,但TSMC等芯片厂能源成本占收入比例很低,可承受电价大幅上涨,AI芯片生产不太可能受扰。


推荐理由:作者以计算供应链为主线,逐项评估能源、氦气与海湾资本对AI的实际冲击程度,结论克制且有依据。

4月8日4月8日周三

星期三 · 1 条
00:00
Cognition 模型 / Devin 博客(网页)精选
AI 评分 62/100
Cognition 拆解 Devin 如何在财富 500 强企业现代化 COBOL

Cognition 发文介绍过去八个月多家财富 500 强公司在 COBOL 项目中使用 Devin,包括用 DeepWiki 文档化数百万行代码、将 25000 行海关工作流迁移到 AWS Lambda(估算节省 73% 迁移成本),以及 Itaú Unibanco 跨数百个程序、20 种字段变体的税号重构,提前三个月完成且零生产错误。


推荐理由:原文梳理了 COBOL 难倒智能体的三个原因和可落地的两类场景,并给出迁移成本下降等具体案例,方法可参考。

4月7日4月7日周二

星期二 · 1 条
08:00
Epoch AI:研究、数据与评测精选
AI 评分 62/100
Epoch AI 分析:算力贫乏的 AI 实验室能否靠效率追赶 GPT 前沿

Epoch AI 分析指出,Anthropic 去年在算力上的支出超过 Minimax 与智谱 AI 之和的十倍,OpenAI 的差距更大,中国与开源模型公司因此处于"算力贫乏"状态。文章梳理了三条提升算力效率的路径:更快研发新算法、复现前沿实验室的创新、利用对手模型生成合成数据训练,其中只有第一条有望实现反超。


推荐理由:原文逐项检验算法创新、模仿与蒸馏三条效率路径能否弥补十倍算力差距,并给出中美与开源模型格局的分层判断。