精选归档 · 第 3 页

4160 条 · 共 577

8月29日8月29日周六

星期六 · 2 条
02:56
Ars Technica:AI(RSS)精选
AI 评分 71/100
联邦法官裁定特朗普政府将 Anthropic 列入黑名单违法

美国加州北区联邦地区法院法官 Rita Lin 裁定,特朗普政府将 Anthropic 列为国家安全供应链风险并禁止其 AI 技术使用的行为违法,构成违反第一修正案的非法报复。裁决指出,Anthropic 因拒绝放弃对其产品用于致命自主战争和大规模监控美国人的限制而遭政府封禁。法院批准了 Anthropic 部分即决判决动议。


推荐理由:裁定将政府拉黑定性为对 Anthropic 拒绝放宽致命自主武器与大规模监控限制的报复,为 AI 公司以安全承诺对抗强制采购压力提供可援引判例。
01:25
Anthropic:Research(发表成果 · 网页)精选
AI 评分 78/100
Anthropic 让 Claude 自主训练模型以缓解对齐失败

Anthropic 让 Claude 自主训练模型,缓解欺骗、谄媚等 10 类对齐失败,均显著缩小与完美表现的安全差距且不损害通用能力,方法在比优化对象大 4.7 倍的模型上依然有效。Claude 还超越 28 名人类安全研究员,其欺骗场景最佳方法比人类最佳方案好 20%。


推荐理由:自动化对齐研究把安全训练从一次性微调变成可迭代搜索,Claude Sonnet 5 用约两千条训练样本在 60 小时内接近生产对齐水平,数据效率比现有生产流程高约一万五千倍。

8月28日8月28日周五

星期五 · 1 条
08:25
Claude Platform:开发者版本说明(RSS)精选
AI 评分 63/100
Claude Console 新增个人密钥与服务账号密钥

Claude Console 现已支持创建个人密钥和服务账号密钥,它们以关联账户身份运行并继承相同权限,账户从组织移除后密钥即失效。组织管理员可借此更轻松追踪各账户用量并确保密钥使用合规。这些 API 密钥可限定到特定工作区,也可用于管理端点及账户可访问的任何工作区,工作区 API 密钥仍作为旧版选项保留支持。


推荐理由:个人密钥与服务账号密钥把权限和生命周期绑定到具体账号,组织管理员能按账号追踪用量并做工作区级隔离,比旧工作区密钥的粗粒度授权更易管理。

8月27日8月27日周四

星期四 · 5 条
12:00
Johann Rehberger / Embrace The Red(RSS)精选
AI 评分 77/100
Claude Code Opus 5 Auto Mode 被提示注入攻击链攻破,成功率最高 80%

安全研究员 Johann Rehberger 发布针对 Claude Code Opus 5 Auto Mode 的攻击链,通过诱导 curl 下载 ZIP、Python 模块遮蔽 struct.py 实现代码执行与 C2 回连,小样本下攻击成功率 60% 至 80%。


推荐理由:作者以第一手攻击链演示 Auto Mode 的绕过路径,并对比厂商评测口径,读者可据此校准对沙箱隔离的必要性认知。
08:00
Tomer Tunguz 博客(VC 分析)精选
AI 评分 64/100
每兆瓦收入与AI模型工厂:Anthropic 如何靠推理毛利反哺训练

Anthropic 的每兆瓦收入从 2024 年的负毛利(每 1 美元收入对应 1.94 美元算力成本)扭转为 2026 年 40-50% 的毛利率,并在 2026 年首次实现盈利季度:109 亿美元营收、5.59 亿美元营业利润。


推荐理由:用每兆瓦收入这一口径拆解模型公司的毛利结构,说明推理利润如何反哺训练形成循环。
02:02
Claude:Blog(网页)精选
AI 评分 72/100
Claude in Chrome 正式全面上线

Anthropic 宣布 Claude in Chrome 现已面向所有付费 Claude 套餐全面开放,Claude 可在浏览器中自主执行操作,无需逐步审批。系统通过安全分类器在每次操作前验证其安全性及是否符合用户请求,并强化了针对提示注入攻击的防御。最新评测显示,在启用探测与安全分类器后,自 Opus 4.8 起的所有模型均未出现攻击成功案例。


推荐理由:Claude in Chrome 从逐步确认改为自动批准,改变的是长流程浏览器任务的干预频率,愿意信任安全分类器的用户可把注意力从操作审核转向结果检查。
01:30
Anthropic:Research(发表成果 · 网页)精选
AI 评分 69/100
Anthropic 开放 Claude 真实使用数据供外部独立研究,公布试点结果

Anthropic 今年春季启动试点,通过隐私保护工具 Anthropic Insights(原 Clio)向斯坦福大学 SALT Lab、牛津大学人类信息处理实验室及 METR 三个外部机构开放约 25 万段 2026 年 4-5 月的 Claude.ai 或 Claude Code 对话数据,供其独立设计研究并公开发布结果。


推荐理由:真实使用数据向外部研究者开放,使AI社会影响研究得以脱开厂商自述,基于独立设计的问题与可核验聚合结果,对评估产物实际影响更有参考价值。
01:02
Claude:Blog(网页)精选
AI 评分 69/100
Warp 如何在 Claude 上构建自我改进的智能体

Warp 在 Claude 平台上构建了基于 Agent Skills 的自我改进循环,通过基础技能与改进技能两个文件型技能,将人类反馈转化为对智能体的持续优化。该模式已应用于其整个开源仓库,覆盖数百名贡献者与数千次代码审查。团队建议以原则而非规则编写技能,并强调低摩擦反馈与改进技能的可复用性。


推荐理由:把反馈从会话结束后消失的一次性信息改为可合并的技能文件,人类反馈通过 PR 流程被累积复用,比手动重写提示词更能跨任务持续改进。

8月26日8月26日周三

星期三 · 2 条
02:02
Claude:Blog(网页)精选
AI 评分 67/100
Claude 记忆功能全面打通聊天与 Cowork,用户可逐条查看和编辑

Claude 即日起将聊天与 Claude Cowork 的记忆统一,用户在任一场景对话时都能调用此前积累的上下文,减少重复解释。记忆会在聊天过程中实时更新,用户可在 Memory 设置中按主题查看、编辑或删除每条记忆。健康、信仰等敏感话题默认不存储,但可在设置中开启,且敏感识别号、犯罪记录等始终不会被保存。


推荐理由:价值在把跨会话记忆变成可逐条编辑的文件,修改一处旧公司名就能在后续所有对话中生效,降低长期项目协作里反复交代背景的成本。
00:16
Dwarkesh Patel:Podcast & Blog(RSS)精选
AI 评分 64/100
Dylan Patel:Anthropic 与 OpenAI 到 2028 年将控制全球大部分算力

在最新一期播客中,SemiAnalysis 创始人 Dylan Patel 与 Dwarkesh Patel 讨论实验室经济学,预计 Anthropic 和 OpenAI 到 2028 年将控制全球大部分可用 FLOPs,因其能更好变现算力并出价高于其他方。


推荐理由:六亿美元晶圆厂资本开支最终可能对应超一万亿美元终端AI收入,这个数量级差距能解释实验室愿高价竞购算力并推高市场利率的一种机制。

8月22日8月22日周六

星期六 · 2 条
04:05
Claude Platform:开发者版本说明(RSS)精选
AI 评分 66/100
Claude Platform 发布 Python SDK v1.0,迁移至 httpx2

Anthropic 发布 Claude Python SDK v1.0,HTTP 层从 httpx 迁移至 API 兼容的 httpx2,并移除 Text Completions API 等长期弃用功能。


推荐理由:这次 v1.0 的破坏性变更集中在 HTTP 层与弃用参数,迁移指南给出前后对照,方便维护旧代码的人逐项核对更新点。
01:58
Claude:Blog(网页)精选
AI 评分 61/100
Claude Mythos 5 网络安全能力扩展至更多防御者

Anthropic 宣布 Claude Mythos 5 现已集成至 Claude Security,并即将登陆合作伙伴的网络安全防御工具。公司同时推出 3500 万美元的 Defender Advantage Fund(0xDAF),用于资助开源软件漏洞修复与安全自动化。


推荐理由:相较直接开放模型,以限定输出物提供补丁和告警的控制方式,为防御能力安全放量给出了可参照的产品分发思路,也解释了后续基金与验证计划的逻辑。

8月21日8月21日周五

星期五 · 4 条
22:28
Claude:Blog(网页)精选
AI 评分 73/100
AI 原生 SDLC 实战手册:Anthropic 如何用 Claude 重塑软件开发生命周期

Anthropic 发布 AI 原生 SDLC 实战手册,提出将传统六阶段软件开发生命周期重构为 AI 嵌入各环节的闭环流程。手册指出,当代码不再是瓶颈时,规划、审查、部署等人速环节成为新约束,需通过 Claude 将需求压缩为 intent.md、以技能编码标准、用持续评测替代阶段门禁,并保留人工对关键代码的审查。


推荐理由:把各阶段产物固化为可版本化 markdown 并让下一阶段读取,人工审查就从逐行看代码转向在关卡看代理标记,对改造研发流程的团队有直接参考价值。
08:00
04:27
Claude:Blog(网页)精选
AI 评分 63/100
Claude Platform 正式上线 Computer Use、Skills API 与 Files API,新增浏览器操作工具

Anthropic 宣布 Computer Use、Skills API 与 Files API 在 Claude Platform 全面可用,并新增浏览器操作工具,让智能体可操作软件、调用团队技能并返回成品文件。


推荐理由:这次正式版让 computer use 每轮可执行多个动作,浏览器工具按页面结构而非像素定位元素,长流程任务的调用次数和执行时间可能明显下降,对无 API 系统上的自动化团队影响直接。
01:56
Claude:Blog(网页)精选
AI 评分 60/100
Anthropic 如何开展 AI 教学

Anthropic 发布 Claude Academy,为全球数百万用户提供 AI 教学资源,帮助其安全、有效地使用 AI。该学院课程借鉴其内部员工培训方法,包括 4D AI Fluency Framework 及“ever-boarding”持续学习项目,并强调以问题为中心、培养持久思维模式而非特定操作行为。


推荐理由:把 AI 教育的重心从功能操作转向任务分工与核查强度,4D 框架与按风险比例验证这类心态对组织设计 AI 素养课程有实际参考价值。

8月20日8月20日周四

星期四 · 1 条
21:26
Claude:Blog(网页)精选
AI 评分 65/100
Claude Code 初创公司指南:五大规则与创始人洞见

Anthropic 发布面向初创公司的 Claude Code 使用指南,基于对十余家高增长公司的调研,总结出“人人皆可交付、自动化繁琐工作、信任但验证、为重构而构建、原型-自用-产品化”五大规则。


推荐理由:指南把十几家创业公司实践归纳为五个可操作规则,其中「修复原则而非修复个案」对搭建自改进 agent 流程具有直接参考价值。

8月19日8月19日周三

星期三 · 3 条
06:27
Anthropic:Research(发表成果 · 网页)精选
AI 评分 73/100
Claude 如何加速蛋白质设计与分析化学研究

Anthropic 公布两项实验:Claude(Mythos Preview 和 Opus 4.8)针对 15 个靶点设计蛋白质结合剂,成功 14 个,命中率达 22.6%-35.1%。


推荐理由:把湿实验命中率与行业常规 10-15% 对比,Claude 从零设计蛋白结合体的效率已接近或超过专家,可压缩药物发现早期的计算与人工周期。
03:26
Claude:Blog(网页)精选
AI 评分 63/100
Claude Tag 如何担任 Anthropic CI/CD 故障的一线响应者

Anthropic 的 CI 工程师用 Claude Tag 构建了值班智能体,作为 CI/CD 故障的一线响应者。Claude 在事故发生后中位 14 分钟发布首份基于证据的分析,最快案例中 3 分钟内验证修复并确认错误率恢复基线。该方案通过 Slack 频道、Datadog 或 Grafana 工具访问及 GitHub 技能文件实现,Anthropic 已发布通用设置套件供其他团队部署。


推荐理由:文章把 AI on-call 从概念落成可复制的工程架构,用 markdown 技能文件和 lessons.md 实现自我迭代,并给出 14 分钟首报、最快 4 分钟定位等实测数据。