精选归档 · 第 6 页

101120 条 · 共 968

8月7日8月7日周五

星期五 · 3 条
10:11
公众号:千问APP(阿里)精选
AI 评分 67/100
千问功能上新:推出思考研究、定时任务、办公助理、语音通话等多项新功能,并支持 Qwen3.8-MAX

千问今日上线多项新功能,并支持最新旗舰模型 Qwen3.8-MAX。其中“思考研究”在原“深度思考”基础上升级,强化复杂推理与工具调用;“定时任务”可预设执行时间自动完成行业简报梳理等周期工作;“办公助理”能连接备忘录、日历等应用并操作电脑浏览器,直接输出可用的 Office 文档。语音通话支持 7x24 小时多场景,智能体广场首批覆盖物流、房产等十多个领域。


推荐理由:办公助理将大模型从问答扩展到任务执行,多步操作与跨端协同可能改变繁琐的数据汇总与文档生成流程。
00:53
Google Developers Blog(RSS)精选
AI 评分 75/100
Agent Plugins 1.0.0 发布:谷歌、亚马逊、微软等支持的统一智能体插件规范

Agent Plugins 1.0.0 是一项由谷歌、亚马逊、微软等支持的中立目录规范,将 Agent Skills 和 MCP 服务器打包为单一可移植单元。通过标准化 plugin.json 清单和固定目录布局,开发者无需为不同 AI 编码智能体和 IDE 维护单独封装。谷歌已作为核心维护者加入,并在 Agents CLI 和 Data Agent Kit 中提供支持。


推荐理由:此前不同AI编码代理和IDE的插件需要单独适配,Agent Plugins通过统一manifest和目录结构,使单个插件可跨工具复用,降低了多代理环境的分发成本。

8月6日8月6日周四

星期四 · 4 条
21:56
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 77/100
Kitesurf:一款在 V8 隔离环境中运行的"代理优先"浏览器

Cloudflare 推出 Kitesurf,一款专为 AI 智能体设计的浏览器,完全运行在 Workers 上,基于 V8 隔离环境,现已在 Browser Run 中免费开放测试。


推荐理由:Kitesurf 将浏览器重新设计为无状态、隔离的 Agent 引擎,CPU 和内存占用仅为 Chromium 的 1/3 到 1/7,这对大规模自动化任务的成本结构可能产生实质影响。
21:10
IT之家(RSS)精选
AI 评分 71/100
谷歌地图 Ask Maps 智能体升级:可对话订餐、找酒店并接入 Gemini Personal Intelligence

谷歌地图宣布 Ask Maps 迎来新一轮升级,新增智能体功能,可替用户执行订餐操作,并综合考虑饮食要求、当前位置和收藏地点等信息;用户还可通过对话指定装修风格、环境氛围等条件查找酒店和当地活动。


推荐理由:在地图导航中直接完成订餐和订房,把位置感知的便利性延伸到了生活服务的交易环节,可能改变用户对地图工具的功能预期。
20:10
公众号:千问APP(阿里)精选
AI 评分 64/100
千问全网首发公测,全新 Wan3.0 来了!

阿里千问全网首发公测视频生成模型 Wan3.0,在生成时长、镜头语言、角色真实感及一致性保持等维度全面升级。该模型支持稳定直出 30 秒一镜到底视频,具备导演级镜头与蒙太奇叙事,并强调角色、道具、场景高一致性保持。Wan3.0 主打超高性价比,现已在千问创作(c.qianwen.com)开放体验,千问 app 也将陆续开启。


推荐理由:30秒一镜到底和导演级镜头控制将视频生成从短片段推向长叙事,配合低试错成本,可能加速短剧和广告的创作节奏。

8月5日8月5日周三

星期三 · 10 条
21:56
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 80/100
Cloudflare OS:面向代理、应用和工作的开放平台

Cloudflare 开源 Cloudflare OS,一个面向代理、应用和工作的开放平台,为每位员工提供基于公司上下文和技能的代理工作区,支持创建文档、幻灯片、应用及运行确定性工作流。该平台内置安全与治理框架,确保协作不泄露未授权信息。任何组织均可部署并连接内部系统。


推荐理由:Cloudflare OS 将企业上下文与内部系统接入 Agent 工作区,Gatekeepers 把权限管控从工具延伸到数据观察链和安全共享,更适合合规要求高的组织部署。
12:35
08:55
Simon Willison 博客精选
AI 评分 79/100
LLM 0.32 发布:新增推理轨迹、OpenAI Responses、服务端工具与更智能的日志

Simon Willison 发布 LLM 0.32,这是该项目自启动以来最重要的新版本。新版本支持显示推理轨迹、服务端工具、OpenAI Responses API,并默认使用 GPT-5.6 Luna 模型。


推荐理由:推理追踪输出到标准错误,日志改为内容寻址存储,让 LLM 作为管道工具和代理框架都摆脱了早期消息抽象带来的重复与混乱。
02:34
01:51
LMSYS:Blog(Chatbot Arena 团队)精选
AI 评分 72/100
SpecForge v0.3.0 发布:统一解耦与共置投机解码栈,新增开放 SpecBundle 草稿模型

SpecForge v0.3.0 将目标模型推理与草稿模型训练分离,支持 EAGLE3、EAGLE3.1、P-EAGLE、DFlash、Domino、DSpark 等多种投机解码算法,并统一在线、离线与解耦工作流。


推荐理由:将目标模型推理与草稿模型训练分离,让两种工作负载可独立扩缩,改变了投机解码训练中资源配比必须硬编码的旧模式,资源规划可按模型和序列长度灵活调整。
00:45
Google Developers Blog(RSS)精选
AI 评分 61/100
Google Cloud API Gateway 推出统一模型路由功能,支持 Gemini、Claude 与 OpenAI OSS-GPT

Google Cloud API Gateway 新增模型路由功能(Public Preview),开发者可在 OpenAPI 3.x 规范中配置虚拟模型名到后端目标的映射,无需硬编码端点或管理开源代理。网关作为无服务器入口层,接受标准 OpenAI 兼容请求,自动将负载转码为目标模型的原生格式并动态路由流量。


推荐理由:将模型路由规则直接内嵌到 OpenAPI 规范中,减少了多模型调度时的入口适配工作,也无需自行维护代理层。
00:34
OpenRouter:Announcements(RSS)精选
AI 评分 73/100
OpenRouter 推出 ori CLI:为 Claude Code 等 Harness 提供开箱即用的优化配置

OpenRouter 发布 ori CLI,用户安装并登录后即可获得针对 Claude Code、Codex、OpenCode、Hermes 等 harness 的优化配置,省去手动设置大量环境变量的麻烦。


推荐理由:把十个环境变量压缩成一条cli命令,且根据模型自动切换工具搜索等设置,让网关切换不再伴生配置摩擦。
00:33
Google Cloud:Databases(RSS)精选
AI 评分 60/100
Google Cloud 推出 Database Operations Agents,实现自主数据库管理

Google Cloud 在 Agentic Data Cloud 发布中推出两款 AI 数据库智能体:Database Onboarding Agent 负责 Day 0 的配置与部署,Database Observability Agent 负责 Day 1/2 的监控、故障排查与维护。


推荐理由:数据库代理将排错和调优从手动查找变为自然语言交互,DevOps团队可能因此缩短平均恢复时间。
00:00
Prime Intellect(网页)精选
AI 评分 71/100
Prime Intellect 开源发布自改进编码智能体 Prime Agent

Prime Intellect 发布开源编码智能体 Prime Agent,围绕递归语言模型(RLM)和 Continual Harness 两个抽象构建,以持久 IPython 内核作为唯一工具,让模型以编程方式调用子智能体并对提示词、技能、记忆和子智能体做增删改查,通过 /refine 从自身轨迹中持续改进 harness。


推荐理由:原文详述 RLM 与 Continual Harness 两个核心抽象及长上下文、游戏等实测结果,读者可据此评估这种可自我改进的 harness 设计是否值得接入自己的工作流。

8月4日8月4日周二

星期二 · 3 条
23:12
NVIDIA Blog(RSS)精选
AI 评分 62/100
NVIDIA 开源 cuFile API,推动 GPU 直连存储

NVIDIA 在 FMS 大会上宣布开源 cuFile API 及底层存储软件栈,让 GPU 可直接读写存储,访问延迟降至微秒级。其 Vera CPU 在两级压缩与加密流水线中吞吐量比 x86 CPU 最高提升 3.21 倍,并联合 40 多家厂商推出 Storage-Next 计划。


推荐理由:cuFile 开源让 GPU 直存访问成为可跨平台协作的开放标准,这会改变 AI 基础设施团队评估存储架构的方式,不再只绑定单一厂商的实现。
15:03
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 81/100
Swiftlet:在 Mac 上运行 80B 版 Qwen(内存 4.3 GB),在 iPhone 上运行 35B 版

Swiftlet 是一个 Swift + Metal 运行时,可在普通 Apple 设备上运行 Qwen3-Next 和 Qwen3.5/3.6 MoE 混合模型,仅将小型稠密核心驻留内存,按需从存储流式加载路由专家权重。


推荐理由:用流式专家加载把 80B 模型塞进手机,具体 RAM 和速度数字让开发者能直接判断自己设备的上限,而不是停留在商详口号。
06:35
Greg Brockman@gdb精选
AI 评分 66/100
GPT-Live实时音频新架构发布GPT-Live is a new architecture and stack for realtime audio:GPT-Live 是一种用于实时音频的新架构和栈: GPT-Live 可以在说话的同时聆听。 为了让这种体验在 ChatGPT 规模下显得自然,我们从客户端到模型重建了语音栈。 这一新架构让音频持续流动,因此更深入的推理和工具使用不会打断对话。

OpenAI: GPT-Live 可以在说话的同时聆听。 为了让这种体验在 ChatGPT 的规模下显得自然,我们从客户端到模型彻底重建了语音技术栈。 这一新架构让音频持续流动,因此更深入的推理和工具调用不会打断对话。


推荐理由:在 GPT-Live 架构下推理与工具调用期间音频流不间断,语音交互的等待感和打断感被显著消除,适用于需要持续对话的陪伴和协作场景。