Topic · 主题全部主题 →

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

8,313条收录
897条精选

精选归档 · 第 14 页

261280 条 · 共 897

6月24日6月24日周三

星期三 · 2 条
01:09
Anthropic:Newsroom(网页)精选
AI 评分 56/100
Anthropic 推出 Claude Tag:在 Slack 中通过 @Claude 协作

Anthropic 推出 Claude Tag,一种在 Slack 频道中通过 @Claude 委托任务的新协作方式。Claude 可记住频道上下文,支持多用户交互,经授权后可自动学习其他频道和数据源。开启“环境”行为后,能主动更新未解决的线程或任务。支持异步工作,可自主推进项目数小时或数天。即日起面向 Claude Enterprise 和 Team 客户提供 beta 版。管理员可精细控制工具和渠道访问权限、设置 token 消耗限额,并查看所有操作日志。


推荐理由:Anthropic 这次把 Claude 从对话助手变成了团队里的主动队友,Slack 里的多人协作、上下文学习和异步代理是个新思路。内部 65% 代码由它生成的数据,让这个方向不再只是实验。

6月23日6月23日周二

星期二 · 7 条
21:20
Hugging Face:Blog(RSS)精选
AI 评分 73/100
IBM 开源 CUGA:轻量级智能体框架,提供二十余个单文件示例应用

IBM 开源了 CUGA(Configurable Generalist Agent),一个处理规划、执行循环、工具调用和状态管理的轻量级智能体框架。开发者只需提供工具列表和提示词即可构建 CugaAgent。内置计划-执行-反思循环,在 AppWorld(2025年7月–2026年2月)和 WebArena(2025年2月–9月)基准上排名第一。支持 Fast / Balanced / Accurate 三种推理模式,代码执行可在本地、Docker 或 E2B 沙箱中运行。可互换工具支持 OpenAPI、MCP 和 LangChain 函数,通过环境变量一键切换 OpenAI、watsonx、Ollama 等提供商。随框架发布二十余个单文件示例应用,涵盖电影推荐、IBM Cloud 架构顾问等场景,每个应用仅需一个 FastAPI 文件。


推荐理由:CUGA 把 agent 的规划、状态、策略等繁琐工程压缩成配置,开发者只写工具列表和 prompt 就能跑起 agent,配套的二十多个单文件应用是现成的模板库,对自建 agent 的团队来说省去了八成重复工作。
19:10
公众号:千问APP(阿里)精选
AI 评分 60/100
国内首个高考志愿AI测评出炉,千问多项表现超过资深咨询师

友松实验室发布国内首个高考志愿AI能力测评报告,测试千问高考志愿填报Agent四大模块。与53位平均从业4.6年的人类咨询师对照,千问表现更稳定精确:44道事实题全对;模拟10个志愿中6个可录取;100场匿名对比中专家58次倾向千问回答。使用千问辅助后,人类咨询师正确率提升,耗时减少约27%。该Agent基于千问高考志愿大模型和夸克8年高考数据,覆盖约3000所院校、2000多个专业。


推荐理由:千问高考志愿Agent的测评报告,数据看着漂亮,但全是阿里自家实验室出品,参考意义不大,真填志愿还是得找独立第三方。
07:18
Runway:News(网页)精选
AI 评分 59/100
Aleph 2.0 现已集成到 Figma Weave

Aleph 2.0 是 Runway 的旗舰视频编辑模型,现已在 Figma Weave 中上线。它是一个基于上下文的视频编辑模型,通过关键帧工作:从视频中提取一帧,重新设计风格并附上时间戳连接回 Aleph 2.0 节点,即可将该编辑传递到主体出现的每一帧,同时保持其他内容不变。支持最长 30 秒、1080p 的片段,可跨多镜头序列应用编辑,无需逐镜头处理。


推荐理由:Runway 把旗舰视频编辑模型直接接入了 Figma 的创意画布,对设计师和视频团队来说,这意味着帧级编辑不用切换工具,协作流程可能大幅简化。
05:19
Claude:Blog(网页)精选
AI 评分 55/100
在 AWS、Google Cloud 和 Microsoft Foundry 上使用完整版 Claude Desktop

通过 AWS、Google Cloud 和 Microsoft Foundry 使用 Claude Desktop 的组织现已获得 Chat、Claude Cowork 和 Claude Code 集成的完整桌面体验。IT 团队可将推理保留在自己的云环境中,对话历史本地存储。支持 IAM Identity Center、Workforce Identity Federation、Microsoft Entra ID 或 Okta 登录;策略模板可导出至 Intune、GPO 或 Jamf;提供离线安装器。Chat、Claude Cowork 和 Claude Code 各有独立策略键,支持精细访问控制。M365 连接器通过 Entra 应用访问邮件和文档,并支持 GCC High/DoD 端点。


推荐理由:Anthropic 把 Claude Desktop 的完整体验带到了自家云环境之外,对于已经在 AWS 或 Azure 上跑推理的团队,终于可以从同一入口覆盖聊天、协作和编码,不用再切工具了。
05:12
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 72/100
Show HN:Oak--专为代理设计的 Git 替代方案

Oak 是开源版本控制系统,专为 AI 智能体(Claude Code、Codex、Cursor)设计。采用 BLAKE3 内容哈希、内容定义分块、diff/merge 及 Blob/Manifest/Commit/Tree 数据模型,可选 SQLite 和 git 后端。以分支-会话为基本工作单元,用分支描述替代逐次提交,通过内容寻址懒加载使智能体数秒内编辑任意仓库。速度远超 git。已发布公开测试版 v0.99.0,支持 macOS(Apple Silicon)、Linux(x86_64)及 Windows,可通过 curl 或 cargo 安装,Apache-2.0 开源。


推荐理由:专为 AI 代理打造的全新版本控制工具,分支作为会话单元、内容寻址懒加载,设计直接摆脱了 git 的包袱,用 agent 的开发者值得一试。
03:10
MarkTechPost(RSS)精选
AI 评分 76/100
Sakana AI 发布多智能体编排系统 Sakana Fugu,对外表现为单一模型

今日 Sakana AI 发布 Sakana Fugu,一个多智能体编排系统,对外表现为单一模型。用户通过 OpenAI 兼容端点发送请求,Fugu 内部决定直接求解或组建专家模型团队协作。提供两个变体:Fugu(平衡性能与低延迟,支持特定 agent opt-out)和 Fugu Ultra(针对困难多步问题优化,固定 agent 池,当前模型 ID 为 fugu-ultra-20260615)。在 11 项基准测试中,Fugu Ultra 在 SWE Bench Pro(73.7%)、TerminalBench 2.1(82.1%)、LiveCodeBench(93.2%)、Humanity’s Last Exam(50.0%)等 10 项上取得最高分,表现与 Anthropic 的 Fable 5 和 Mythos Preview 相当。Fugu 通过 OpenAI 兼容 API 调用,无需更换 SDK,并支持 opt-out 以应对合规和单供应商风险。


推荐理由:Sakana AI 把多模型调度塞进一个 API,基准分压倒了它协调的单独模型,对降低供应商依赖的团队是个新路标,但自研路由也意味着锁死模型选型。
00:11
xAI:News(网页)精选
AI 评分 69/100
Grok Build 推出 /goal 模式,支持长时间自主任务执行

xAI 在 Grok Build 中引入 /goal 新模式。用户只需用一行命令设定目标,agent 便会自动规划方案、分解任务为进度清单并持续执行,直至目标完成且通过验证,期间可额外下达指令。该模式支持监控与引导命令,任务完成时清单全部勾选。即日起可用,用户可通过 curl -fsSL | bash 安装 CLI 并登录账号即可使用。


推荐理由:把Grok Build从单步指令升级成可长期自主执行任务的Agent,对习惯把代码扔给AI就跑开的开发者很友好,但目前只有CLI,生态还没铺开。

6月22日6月22日周一

星期一 · 1 条
07:01
Simon Willison 博客精选
AI 评分 72/100
Cloudflare 临时账户 for AI agents

Cloudflare 推出临时账户功能,无需注册即可通过 npx wrangler deploy --temporary 部署 Workers 项目,临时项目存活 60 分钟。该功能虽标称为 AI 智能体设计,但普通用户同样适用。作者使用 GPT-5.5 xhigh 在 Codex Desktop 中构建了测试应用,验证了部署与运行流程,并展示了项目认领页面。


推荐理由:虽然这次打的旗号是服务 AI 智能体,但临时 Cloudflare 账号对任何想快速部署原型的开发者都是福音,降低了不少环境搭建的摩擦,值得马上试试。

6月21日6月21日周日

星期日 · 1 条
19:05
AYi@AYi_AInotes精选
AI 评分 78/100
美团tabbit国际版免费接入GPT-5.5/Claude Opus 4.8等旗舰模型我去,GPT 5.5, Claude Opus 4.8, Gemini 3.5flash,最新旗舰版全接入,完全免费不用单独开订阅!美团最近悄悄上了一个叫 tabbit 国际版的应用,里面接了好几家顶级模型,Claude、Gemini、GPT,都是最新旗舰版。国内这边也没落下,Kimi、GLM、MiniMax 都在。唯一的坑:一定要下国际版, 国内版只有国内模型,御三家不接入,这东西的逻辑很简单,美团想做 AI 入口,先砸钱把模型阵容堆满,把用户量拉起来, 现阶段一分钱不花就能同时用几家最贵的模型,之前不想在各家之间来回切,又不想开一堆订阅的人,这个方案挺省心的,趁现在还没收费,先用着,谢谢兄弟@fengdu2077挖掘到这么好的工具!亲测有效!美团近期上线tabbit国际版应用,免费集成多家顶级AI模型的最新旗舰版,包括GPT-5.5、Claude Opus 4.8、Gemini 3.5 Flash,以及国内Kimi-2.6、GLM-5.1、MiniMax-M3。用户无需单独订阅即可使用这些模型。需注意:只有国际版包含海外模型,国内版仅提供国内模型。该应用旨在抢占AI入口,目前处于免费推广阶段。

风渡fengdu: 分享一个免费用 Claude 、Gemini、GPT的方法,都是可用他们的最新旗舰模型。 除了御三家,还有国内的明星模型:Kimi-2.6、GLM-5.1、MiniMax-M3 只要下载一个美团的「tabbit 国际版」,记住要用国际版的才...


推荐理由:美团做AI入口的野心藏不住了,tabbit国际版一口吞下三家旗舰模型还全免费,对不想开多订阅的用户是实用降本方案,趁未收费值得试试。

6月20日6月20日周六

星期六 · 2 条
17:59
IT之家(RSS)精选
AI 评分 73/100
微信 AI 助手"小微"灰度上线,可通过文字或语音对话操作原生功能

微信原生 AI 助手“小微”今日扩大灰度测试,支持文字或语音操作微信原生功能(调整设置、发送消息、拨打电话、点外卖、生成图片等),集成文件总结、提醒设置、音乐推荐。用户可一句话生成小程序(仅限个人使用,暂不支持分享),并可通过多轮对话修改风格。该功能由微信技术架构负责人周颢带队推进,计划 2026 年第三季度向更多用户推出。此前微信开放平台已于 6 月 8 日开放 AI 生态接入能力,微信支付同步发布 AI 专属卡。

另有 1 家信源报道公众号:数字生命卡兹克
推荐理由:微信这次把 AI 助手直接塞进主界面,不止是聊天,而是能操作设置、发消息、点外卖甚至一句话生成小程序。国民应用 + 原生 AI 的整合,可能会让这代人对智能助手的理解彻底刷新一遍。
15:59
IT之家(RSS)精选
AI 评分 75/100
马斯克 SpaceXAI 为微软 Office 推出 Grok 扩展,支持自然语言操控文档、表格和演示文稿

6月19日,马斯克旗下SpaceXAI面向微软Word、Excel、PowerPoint推出Grok扩展。安装后Office应用右侧出现侧边栏,支持自然语言指令操控。Word中,Grok可根据草稿和格式自动生成文档,识别语法错误并提出表述建议,还能调用X平台及互联网实时信息补充数据。Excel中,Grok可分析选中区域数据,进行统计、趋势识别并一键生成图表。PowerPoint中,输入主题、页数和风格,Grok自动生成幻灯片框架并填充内容。


推荐理由:SpaceXAI 把 Grok 带进 Office,不是简单的对话侧边栏,而是能调用 X 实时数据的生产力插件。比起 Copilot 的封闭数据,Grok 的实时联网让报告和数据分析更有血有肉,做市场的同学可以试试。

6月19日6月19日周五

星期五 · 7 条
13:19
AYi@AYi_AInotes精选
AI 评分 79/100
阿里开源向量数据库Zvec,UCSD黄碧薇教授提出因果AI第四代范式卧槽,阿里把内部用了多年的向量数据库直接开源了,Pinecone每月70刀的能力,它pip一行免费就能用,十亿向量毫秒级还不用单独起服务🤯以后做RAG和AI搜索的,不用再每月给Pinecone交70美金了!阿里内部跑了多年的向量数据库开叫Zvec, 一行pip install就能跑,完全免费。三个最硬核的特性, 1️⃣十亿向量毫秒级检索,不用单独起服务,直接嵌进应用进程。 2️⃣从服务器到桌面端再到树莓派,全平台通吃。 3️⃣全语言官方SDK,v0.5.0新增原生全文混合搜索,向量关键词过滤器一次查完。我觉得阿里这是把自用的生产级轮子,直接拆给全行业用了,以后AI应用的底层底座,又多了一个免费的靠谱选项啦~pip install zvec。阿里开源内部向量数据库Zvec,pip install zvec免费使用,对标Pinecone每月70美元能力。支持十亿向量毫秒级检索,无需单独起服务,全平台兼容;v0.5.0新增原生全文混合搜索。UCSD黄碧薇教授(causal-learn作者)提出AI四代范式:相关性小模型→因果小模型→相关性大模型(LLM)→因果大模型,认为当前正站在第四代门口。其创立的Aether AI完成首轮融资,致力于从视频中自动抽取物理规律,探索下一代因果AI范式。

AYi: 人类到今天都写不出一颗煎蛋的物理方程, 一颗鸡蛋打进热油锅,它怎么凝固、怎么摊开、边缘怎么变焦, 没有任何一个公式能描述清楚,这种例子在物理世界里多到数不过来。 而这恰恰是当下通用 AI 范式的天花板,视频生成、VLA 学的都是像素层面的统...


推荐理由:阿里把内部跑了多年的向量数据库开源了,pip一行直接跑,十亿级毫秒检索还不占额外服务,做RAG和搜索的不用再每月给Pinecone交钱,虽然刚起步,但免费生产级轮子值得一试。
06:27
LangChain:Blog(RSS)精选
AI 评分 64/100
LangSmith 推出 No Code Agent Builder,无需代码即可构建 AI 智能体

LangSmith 发布 No Code Agent Builder,允许用户无需编写代码即可创建具备记忆、引导提示词和 MCP 工具的 AI 智能体。该工具面向无技术背景的用户,降低了构建智能体的门槛。


推荐理由:LangSmith 把 agent 构建拉到零代码,记忆和 MCP 支持让非技术人员也能上手,对 LangChain 生态是聪明的入口策略,但复杂场景的灵活性还得观察。
03:26
xAI:News(网页)精选
AI 评分 61/100
xAI 发布 Grok for Word 插件

xAI 将 Grok 引入 Microsoft Word,推出免费 365 插件。用户可将笔记转为结构化文档、重写文本以提升清晰度与简洁性,也能通过插件搜索网页、X 平台或生成图表。插件支持连接 SharePoint 和 Google Drive 等外部来源,还可用于 PowerPoint 和 Excel。


推荐理由:Grok 正式进入 Office 生态,在 Word 里能直接整理笔记、搜索网页和生成图表,对日常办公用户是个顺手工具,但和微软 Copilot 的边界很模糊。
03:08
OpenAI:官网动态(RSS · 排除企业/客户案例)精选
AI 评分 58/100
企业版新用量分析与更新的支出控制

OpenAI 为 ChatGPT Enterprise 推出信用额度用量分析与更新的支出控制功能。全局管理控制台(Global Admin Console)统一展示 ChatGPT 和 Codex 的信用消耗,支持按时间、用户、产品、模型追踪用量趋势。管理员可为整个工作区设置默认限额,按群组配置额度,并为个人设置叠加限制。员工可查看个人用量并申请增加额度(附工作上下文)。这些功能即日起可用。


推荐理由:仅面向ChatGPT Enterprise管理员的使用分析和预算控制更新,帮助企业追踪团队用量、控制成本,但并非行业级事件,管理者可当即启用。
02:54
Claude:Blog(网页)精选
AI 评分 72/100
Claude Code 现已支持 artifacts

从今日起,Claude Code 可将工作进度生成为 artifacts——实时、可分享的交互式网页,涵盖 PR 走查、系统说明、仪表盘、发布清单等。artifacts 基于会话完整上下文(代码库、连接器、对话)自动构建,更新时页面原地刷新,同事即时可见。默认仅作者可见,可分享给组织内成员,由管理员通过组织层级开关和角色权限管控。内部测试中最常见用例为调试:工程师调查事件,Claude Code 分析日志并发布包含时间线、嫌疑提交和错误率图表的 artifact,团队无需再“走过场式汇报”。


推荐理由:Artifacts 把 Claude Code 里的工作进展变成可分享、自动更新的活页面,等于给开发协作装了个实时投影仪,但仅限企业用户,个人开发者还得再等等。
02:22
OpenAI:官网动态(RSS · 排除企业/客户案例)精选
AI 评分 82/100
GPT-5.5 Instant提升ChatGPT健康智能

每周超2.3亿用户通过ChatGPT获取健康信息。GPT-5.5 Instant在健康评估中表现显著提升,最具挑战性评测上达到前沿Thinking模型水平,已面向所有免费用户开放。基于医生编写的HealthBench和HealthBench Professional评估,其回复在准确性、安全性和沟通质量上优于医生手写回复及早期模型,故障模式发生率更低。近两个月生产流量显示,健康类回复事实性问题率下降71%。

另有 3 家信源报道The Decoder:AI News(RSS)X:Rohan Paul (@rohanpaul_ai)X:Greg Brockman (@gdb)
推荐理由:GPT-5.5 Instant把健康智能提升到接近前沿思考模型水平并免费提供,与医生对比的实验和71%的错误率下降让这次更新有切实证据。