精选归档 · 第 3 页

4160 条 · 共 969

8月31日8月31日周一

星期一 · 1 条
08:40

8月28日8月28日周五

星期五 · 1 条
08:25
Claude Platform:开发者版本说明(RSS)精选
AI 评分 63/100
Claude Console 新增个人密钥与服务账号密钥

Claude Console 现已支持创建个人密钥和服务账号密钥,它们以关联账户身份运行并继承相同权限,账户从组织移除后密钥即失效。组织管理员可借此更轻松追踪各账户用量并确保密钥使用合规。这些 API 密钥可限定到特定工作区,也可用于管理端点及账户可访问的任何工作区,工作区 API 密钥仍作为旧版选项保留支持。


推荐理由:个人密钥与服务账号密钥把权限和生命周期绑定到具体账号,组织管理员能按账号追踪用量并做工作区级隔离,比旧工作区密钥的粗粒度授权更易管理。

8月27日8月27日周四

星期四 · 2 条
22:43
Unsloth AI@UnslothAI精选
AI 评分 71/100
Unsloth 发布 GLM-5.3-Flash GGUF 量化版本地运行方案GLM-5.3-Flash can now be run locally! ✨Run 3-bit on 128GB RAM via Unsloth GGUF.GLM-5.3-Flash (ox-alpha) rivals Claude Opus 4.8 on DeepSWE, coding & agentic benchmarks.Guide: https://unsloth.ai/docs/models/glm-5.3-flash GGUF: https://huggingface.co/unsloth/GLM-5.3-Flash-GGUFUnsloth 发布 GLM-5.3-Flash(ox-alpha)的 GGUF 量化版本,可在 128GB RAM 设备上以 3-bit 运行。该模型为 Z.ai 的 320B-A18B 开源多模态模型,MIT License 发布,原文称其在 DeepSWE、编码和智能体基准上媲美 Claude Opus 4.8。

Z.ai: 隆重推出 GLM-5.3-Flash - 以极具竞争力的价格提供领先能力 - 原生多模态,具备 1M-token 上下文窗口 - 一个以 MIT 许可证发布的 320B-A18B 模型 - 此前以 Ox Alpha 为名预览,完全运行于中国...


推荐理由:原文给出了各量化档位的内存需求和精度保留数据,读者可据此判断在 128GB 设备上本地运行该模型的可行性。
02:02
Claude:Blog(网页)精选
AI 评分 72/100
Claude in Chrome 正式全面上线

Anthropic 宣布 Claude in Chrome 现已面向所有付费 Claude 套餐全面开放,Claude 可在浏览器中自主执行操作,无需逐步审批。系统通过安全分类器在每次操作前验证其安全性及是否符合用户请求,并强化了针对提示注入攻击的防御。最新评测显示,在启用探测与安全分类器后,自 Opus 4.8 起的所有模型均未出现攻击成功案例。


推荐理由:Claude in Chrome 从逐步确认改为自动批准,改变的是长流程浏览器任务的干预频率,愿意信任安全分类器的用户可把注意力从操作审核转向结果检查。

8月26日8月26日周三

星期三 · 3 条
09:09
Fireworks AI(网页)精选
AI 评分 68/100
DeepSeek V4 Pro 0813 上线 Fireworks:SWE-Bench Verified 达 95.2%,单任务成本约为 Fable 5 的三分之一

Fireworks 上线 DeepSeek V4 Pro 0813,提供 serverless、专属部署及 SFT/DPO/RFT 训练支持,模型具备 1M token 上下文窗口和原生工具调用。


推荐理由:原文用四组基准和逐任务成本数据对比 V4 Pro 与 Fable 5、Kimi K3,并指出 Java 弱项与路由空间,读者可据此选型。
02:53
Andrew Ng@AndrewYNg精选
AI 评分 67/100
OpenWorker 新版发布,内置网络安全智能体OpenWorker -- an open source agent that doesn't just chat but completes tasks on your laptop -- just released a new version with many features for security workflows.After our initial release, many users found it especially useful for cybersecurity. Attackers are already using AI; OpenWorker is committed to giving defenders the same leverage. Running an agent requires both (i) A model and (ii) A harness (the software around the model). Because the OpenWorker harness is fully open source, security teams can audit it to make sure we haven't built any backdoors that exfiltrate your code and data to some company or even a foreign adversary.OpenWorker now comes with built-in cybersecurity agents for (i) Scanning your code for vulnerabilities. (ii) Scanning dependencies for supply chain injections. (iii) Checking your cloud security configuration for attack surfaces. This enables developers to do much more security work before deployment (part of what's called the "shift left" movement).You choose the model: you can run open weight models fully locally so sensitive code never leaves your machine. This helps with legitimate security work (like reproducing a known exploit to defend against it) that can trigger refusals in leading closed models. Or use your ChatGPT subscription, or stealth preview models like Ox Alpha, or any model via API key.Thanks also to all the open source contributors!Join work with @rohitcprasad so please follow him too to get more frequent updates.Try it out: https://openworker.com/ Code: https://github.com/andrewyng/openworkerAndrew Ng 旗下开源智能体 OpenWorker 发布新版,强化安全工作流。其 harness 完全开源,安全团队可审计无后门。新版内置代码漏洞扫描、依赖供应链注入检测和云安全配置检查三类网络安全智能体,并支持本地运行开源权重模型以保护敏感代码。
推荐理由:OpenWorker 把漏洞、依赖和云配置检查放进可本地运行的开源 agent,安全团队能在代码不出本机的前提下审计工具链,比闭源方案多一层透明。
02:02
Claude:Blog(网页)精选
AI 评分 67/100
Claude 记忆功能全面打通聊天与 Cowork,用户可逐条查看和编辑

Claude 即日起将聊天与 Claude Cowork 的记忆统一,用户在任一场景对话时都能调用此前积累的上下文,减少重复解释。记忆会在聊天过程中实时更新,用户可在 Memory 设置中按主题查看、编辑或删除每条记忆。健康、信仰等敏感话题默认不存储,但可在设置中开启,且敏感识别号、犯罪记录等始终不会被保存。


推荐理由:价值在把跨会话记忆变成可逐条编辑的文件,修改一处旧公司名就能在后续所有对话中生效,降低长期项目协作里反复交代背景的成本。

8月25日8月25日周二

星期二 · 4 条
21:59
Apple:Newsroom(RSS)精选
AI 评分 64/100
Apple 推出搭载 M5 Max 与 M5 Ultra 的全新 Mac Studio

Apple 发布搭载 M5 Max 与全新 M5 Ultra 的 Mac Studio,AI 性能最高提升 4.3 倍,图形性能提升 1.8 倍,存储速度提升 2 倍。M5 Ultra 版本支持最高 512GB 统一内存与 1.2TB/s 内存带宽,可完全在设备端运行大型 LLM;四台集群可带来最高 3 倍分布式 AI 推理速度提升。新品今日起接受预购,9 月 22 日开售。


推荐理由:M5 Ultra 的 512GB 统一内存与每 GPU 核神经加速器,让本地运行超大规模 LLM 从演示走向可用,云成本与 token 计费不再是部署前置条件。
21:57
Apple:Newsroom(RSS)精选
AI 评分 55/100
Apple 发布 M6 与 M5 Ultra,性能与 AI 算力大幅跃升

Apple 推出首款 2nm 芯片 M6,搭载 12 核 CPU、12 核 GPU 及双 16 核神经引擎,统一内存带宽最高 170GB/s,多线程性能较 M5 提升 1.2 倍。M5 Ultra 采用首款四芯片封装架构,最高 36 核 CPU、80 核 GPU,带宽达 1.2TB/s,较 M3 Ultra 提升 50%。两款芯片分别用于新款 Mac mini 与 Mac Studio。


推荐理由:M5 Ultra 的 512GB 统一内存和 1.2TB/s 带宽,让数百亿参数模型可以完全在本地运行,降低了大模型本地部署的硬件门槛。
11:19
公众号:数字生命卡兹克精选
AI 评分 69/100
飞书与豆包合并后首款Agent产品"豆包工作"发布

字节正式发布办公Agent产品“豆包工作”,这是7月30日飞书与豆包产品团队整合后的首个重要产品,也是继WorkBuddy、千问办公之后办公Agent领域的第三个巨头玩家。该产品由豆包原“工作任务”独立而成,与飞书原生打通,支持飞书账号登录,完整继承企业AI额度、文档、多维表格、知识库、聊天、邮件及飞书权限系统,并具备电脑操控功能,可将固定流程封装为可反复调用的Skill。


推荐理由:对比需要频繁配置飞书 CLI 的路径,豆包工作直接继承飞书文档、权限与企业 AI 额度,把已有组织数据变成可调用的工作上下文,可能改变飞书企业部署 Agent 的门槛。
03:56
Meta Engineering Blog(RSS)精选
AI 评分 62/100
MetaRoCE:为 AI 规模以太网打造的全新 RDMA 传输协议

Meta 设计并开源了 MetaRoCE,一个专为 AI 工作负载在通用以太网上打造的 RDMA 传输协议,已通过 Open Compute Project(OCP)发布规范、参考软件实现和合规测试套件。该协议将智能移至端点,原生支持乱序交付、多路径、无损容忍和双向拥塞控制,无需 PFC,可在百万 GPU 规模下提供高吞吐、低尾延迟。现有 RDMA Verbs API 和软件栈无需修改即可运行。


推荐理由:MetaRoCE 把拥塞控制与路径选择交给端点,AI 集群无需 PFC 也能在有损以太网上维持吞吐,实测 1% 丢包下保持 86% 吞吐,为大规模组网去掉无损约束提供了依据。

8月24日8月24日周一

星期一 · 1 条
23:24
NVIDIA Blog(RSS)精选
AI 评分 63/100
NVIDIA Vera Rubin NVL72 树立 AI 智能体效率新标准:每瓦特工作量提升至 30 倍

NVIDIA 实测数据显示,Vera Rubin NVL72 在智能体工作负载下每兆瓦吞吐量较 GB300 NVL72 最高提升 30 倍,每百万 token 成本降低至 35 倍。


推荐理由:对电力受限的 AI 工厂,每兆瓦吞吐量 30 倍提升与 token 成本同步下降,意味着同等能源预算下可承载的 agentic 负载量级不同,部署决策中的成本模型可能改写。

8月22日8月22日周六

星期六 · 3 条
04:05
Claude Platform:开发者版本说明(RSS)精选
AI 评分 66/100
Claude Platform 发布 Python SDK v1.0,迁移至 httpx2

Anthropic 发布 Claude Python SDK v1.0,HTTP 层从 httpx 迁移至 API 兼容的 httpx2,并移除 Text Completions API 等长期弃用功能。


推荐理由:这次 v1.0 的破坏性变更集中在 HTTP 层与弃用参数,迁移指南给出前后对照,方便维护旧代码的人逐项核对更新点。
01:58
Claude:Blog(网页)精选
AI 评分 61/100
Claude Mythos 5 网络安全能力扩展至更多防御者

Anthropic 宣布 Claude Mythos 5 现已集成至 Claude Security,并即将登陆合作伙伴的网络安全防御工具。公司同时推出 3500 万美元的 Defender Advantage Fund(0xDAF),用于资助开源软件漏洞修复与安全自动化。


推荐理由:相较直接开放模型,以限定输出物提供补丁和告警的控制方式,为防御能力安全放量给出了可参照的产品分发思路,也解释了后续基金与验证计划的逻辑。

8月21日8月21日周五

星期五 · 5 条
04:27
Claude:Blog(网页)精选
AI 评分 63/100
Claude Platform 正式上线 Computer Use、Skills API 与 Files API,新增浏览器操作工具

Anthropic 宣布 Computer Use、Skills API 与 Files API 在 Claude Platform 全面可用,并新增浏览器操作工具,让智能体可操作软件、调用团队技能并返回成品文件。


推荐理由:这次正式版让 computer use 每轮可执行多个动作,浏览器工具按页面结构而非像素定位元素,长流程任务的调用次数和执行时间可能明显下降,对无 API 系统上的自动化团队影响直接。
03:38
xAI:News(网页)精选
AI 评分 82/100
Grok Build 全面上线网页与移动端,所有套餐可用

Grok Build 现已面向所有套餐开放,支持网页、iOS 和 Android 端使用。用户描述应用、游戏或网站后,Grok 可在聊天中实时生成可运行版本。该功能自 7 月推出 Early Beta 以来,新增了发布分享、接入 X 及调用 Grok 自身模型等能力,发布的应用可获得 grok.me 链接并支持自定义域名、导出到 GitHub 等。


推荐理由:全量开放把应用生成从早期测试变为普通用户可用的工具,发布链接和X内嵌卡片让作品直接进入社交传播,降低了分享与分发的门槛。
01:56
Claude:Blog(网页)精选
AI 评分 60/100
Anthropic 如何开展 AI 教学

Anthropic 发布 Claude Academy,为全球数百万用户提供 AI 教学资源,帮助其安全、有效地使用 AI。该学院课程借鉴其内部员工培训方法,包括 4D AI Fluency Framework 及“ever-boarding”持续学习项目,并强调以问题为中心、培养持久思维模式而非特定操作行为。


推荐理由:把 AI 教育的重心从功能操作转向任务分工与核查强度,4D 框架与按风险比例验证这类心态对组织设计 AI 素养课程有实际参考价值。
00:47
Google Cloud:Databases(RSS)精选
AI 评分 65/100
AlloyDB ScaNN 如何将向量搜索扩展到 100 亿向量

AlloyDB 的 ScaNN 索引现已支持超过 100 亿向量的规模,通过全新的四层树架构(预览版)实现,将查询复杂度从 O(N^1/2) 降至 O(N^1/4)。内部测试中,该架构在 100 亿向量规模下可实现 p95 延迟不超过 51 毫秒、召回率达 95%。该功能可通过快速入门指南部署,新用户可享受 30 天免费试用。


推荐理由:四层树把搜索复杂度从 O(N^1/2) 逐级降到 O(N^1/4),配合内存优化让向量索引扩到百亿规模,这会影响依赖大规模向量检索的 RAG 应用在做容量规划时的性能假设。
00:02
Mistral AI:News(网页)精选
AI 评分 67/100
Mistral 推出 Agentic Search:多步检索提升 AI 系统复杂文档查询准确率

Mistral 发布 Agentic Search,通过 search、open、navigate、read、grep 五工具的多步检索循环,让模型在长文档与多来源中查找、定位并验证信息。


推荐理由:相比一次性 RAG,五个检索工具让模型按需查证、打开和阅读原文,精度从 26.7% 升到 86%,说明检索质量开始取决于模型推理而非分块策略。