Topic · 主题全部主题 →

MCP 与工具调用

模型连接外部世界的协议与实践:MCP 生态、function calling、工具链集成的动态。

1,288条收录
237条精选

精选归档 · 第 8 页

141160 条 · 共 237

5月27日5月27日周三

星期三 · 2 条
22:09
Runway:News(网页)精选
AI 评分 73/100
Runway 推出 Model Context Protocol 服务器

Runway 正式推出 Runway MCP 服务器,允许任何兼容 MCP 的 AI 智能体(如 Claude、ChatGPT、Cursor)在对话界面中直接生成图像与视频,无需切换工作流。该服务器接入了 Runway 最新的多款 SOTA 模型,包括 Gen-4.5、Seedance 2.0、GPT Image 2、Kling 3.0 及 Nano Banana Pro。其应用场景涵盖为产品制作营销视频、批量生成网站视觉素材、创作角色广告以及在应用开发中集成视觉内容。用户设置简便,通过 runwayml.com/mcp 添加服务器并登录现有 Runway 账户即可使用,无需单独申请 API 密钥。

另有 1 家信源报道X:Runway (@runwayml)
推荐理由:Runway 把 Gen-4.5 和 Seedance 2.0 等模型接入了 MCP,以后做产品图、营销视频不用切窗口,这个集成对依赖视觉内容的 Agent 工作流是个 real upgrade。
09:04
Claude:Blog(网页)精选
AI 评分 75/100
Code w/ Claude 伦敦活动:重塑开发体验

在Code w/ Claude 伦敦活动上,Anthropic 宣布了 Claude Managed Agents 的两项新能力:自托管沙箱(公开测试版)和 MCP 隧道(研究预览)。这两项功能使 AI 智能体的工具执行环境与企业私有网络内的 MCP 服务器连接均可运行在客户自有基础设施或指定托管服务商处。活动还介绍了如何通过 Claude Code、优化思维预算以及模型努力级别来提升开发体验。目前,包括 Spotify、Base44 和 Legora 在内的客户已在使用这些新功能。

另有 2 家信源报道Claude:Blog(网页)X:Claude (@claudeai)
推荐理由:Claude 平台企业部署的最后一公里被补上了,自托管沙箱和 MCP 隧道让 agent 真正能进生产环境,做 2B 的企业级应用终于有了安全底座。

5月26日5月26日周二

星期二 · 2 条
14:11
IT之家(RSS)精选
AI 评分 77/100
"龙虾之父"Peter 开源 skill-cleaner,为 AI 智能体技能"做体检"

“龙虾之父”Peter 开源了 skill-cleaner 工具,用于诊断和优化 AI 智能体的技能提示词。该工具包含5项核心功能,包括技能提示词预算审计、重复技能检测、未使用技能筛查、技能根目录审计和描述精简优化。其脚本采用标准 token 预算核算逻辑,旨在帮助减少冗长描述对 token 预算和上下文窗口的占用。已有用户实践显示,将技能描述从90多词精简至40词以内,能提升智能体选择技能的准确率。


推荐理由:Peter 直接开源了一个给 Skill '减肥' 的工具,把描述精简、重复检测、预算审计全自动化了,装完跑一遍就能直观看到哪些 Skill 在烧你的 token。做 Agent 的可以立刻装上试试。
00:18
Hugging Face:Blog(RSS)精选
AI 评分 58/100
Harness、Scaffold 与 AI 智能体术语辨析

本文旨在厘清 AI 智能体领域中易混淆的关键术语。文章指出,模型(如 Claude、GPT)本身是无记忆、无循环的大语言模型。其行为由“Scaffolding”(行为定义层,如系统提示、工具描述)塑造,而“Harness”(执行层)负责调用模型、处理工具调用与控制循环,是智能体运行的核心。两者结合,模型才能成为智能体。文章以 Claude Code、Codex 为例,说明同一模型搭配不同 Harness 会产生迥异体验,并提出了 Agent = Model + Harness 的常见理解框架。术语尚未统一,本文旨在提供一个实用的心智模型。


推荐理由:Agent圈术语混乱的文章很多,但HF这篇把harness、scaffold、context engineering的关系讲得最透,做agent开发的读完至少能少吵一半的架。

5月25日5月25日周一

星期一 · 1 条

5月23日5月23日周六

星期六 · 1 条
06:30
Claude Code:GitHub Releases(RSS)精选
AI 评分 64/100
v2.1.149 更新摘要

本次 v2.1.149 更新包含功能增强、企业设置和多项修复。新增 /usage 命令的使用量分类显示功能,可区分技能、子代理、插件及每个 MCP 服务器的消耗;/diff 详情视图支持键盘滚动;Markdown 输出兼容 GFM 任务列表。企业版新增 allowAllClaudeAiMcps 设置以加载云 MCP 连接器。修复了 PowerShell 权限绕过、Git 工作树沙盒写入白名单越界、脚本路径含空格时 otelHeadersHelper 静默失败等安全问题。改进了 /feedback 报告,包含上下文压缩前的对话内容,便于排查长会话中的早期问题。


推荐理由:Claude Code 这次把 /usage 拆到每个技能和子代理的用量,排查成本不再是猜谜,/diff 终于能键盘滚动,修了一堆权限坑,日常靠 Claude Code 写代码的人值得秒升。

5月22日5月22日周五

星期五 · 2 条
14:03
公众号:龙猫LongCat(美团)精选
AI 评分 69/100
美团跑腿 Skill:一句话,骑手来帮忙

美团推出跑腿 Skill,接入 Claw 助手后可将六步下单流程压缩为一步,用户用自然语言描述需求即可生成真实跑腿订单。该 Skill 支持所有 Claw 客户端,包括 OpenClaw 本地版、火山引擎云部署版及 QClaw 等第三方客户端,并提供智能地址匹配、订单预览确认、支付安全门控及实时配送进度查询等功能。


推荐理由:将跑腿下单压缩为自然语言交互,展示了AI助手调用线下服务的实际落地路径,对频繁使用跑腿的用户减少了多步操作。

5月21日5月21日周四

星期四 · 1 条
21:40
Qwen@Alibaba_Qwen精选
AI 评分 82/100
Qwen3.7-Max:面向Agent时代的旗舰模型📣Meet Qwen3.7-Max — our latest flagship, made for the Agent Era.A versatile foundation for agents that actually get things done: 🧑💻 Coding agent, end to end. Frontend prototypes, multi-file refactors, real debugging — nails it. 🗂️ A reliable office and productivity assistant. Get your work done through MCP integrations and multi-agent orchestration. ⏱️ Long-horizon autonomy. 35 hours straight on a kernel optimization task — 1,000+ tool calls, zero hand-holding. 🔌 Scaffold-agnostic. Claude Code, OpenClaw, Qwen Code, or your own stack. Consistent reliability everywhere.API's up on Alibaba Model Studio. You can also take it for a spin on Qwen Studio.Go build something wild!🏃🏃♂️📖 Blog: https://qwen.ai/blog?id=qwen3.7 ✅ Qwen Studio: https://chat.qwen.ai/?models=qwen3.7-max ⚡️ API:https://modelstudio.console.alibabacloud.com/ap-southeast-1?tab=doc#/doc/?type=model&url=2840914_2&modelId=qwen3.7-max&serviceSite=internationalQwen3.7-Max是Qwen系列面向Agent时代推出的最新旗舰模型,旨在为能完成实际任务的智能体提供强大基础。其核心能力包括:可作为端到端编码智能体,处理前端原型与多文件重构;作为可靠的办公助手,通过MCP集成与多智能体编排协同工作;并支持超长时间(超过35小时)的自主运行,执行复杂任务链。该模型兼容Claude Code、OpenClaw等主流开发框架,现已上线阿里云模型工作室与Qwen Studio提供服务。
另有 9 家信源报道X:阿里云 / Alibaba Cloud (@alibaba_cloud)公众号:通义实验室(千问)X:通义千问 / Qwen (@Alibaba_Qwen)X:X.PIN (@thexpin)Qwen:Blog Retrieval(API)X:OpenRouter (@OpenRouter)Hacker News 热门(buzzing.cc 中文翻译)IT之家(RSS)X:Rohan Paul (@rohanpaul_ai)
推荐理由:Qwen 3.7-Max 的亮点不在榜上分数,而是它瞄准 Agent 场景的连贯执行能力,35 小时不间断跑 kernel 优化,对需要长线任务的开发者是直接可用的探索方向。

5月20日5月20日周三

星期三 · 3 条
04:25
Google Developers Blog(RSS)精选
AI 评分 65/100
更智能的 Google AI Edge Gallery:MCP 集成、通知和会话连续性

Google AI Edge Gallery 应用在安卓平台上扩展了设备端 AI 能力,通过引入对开源模型上下文协议(MCP)的实验性支持,使得 Gemma 4 模型能够协调处理跨 Google Workspace 和 Google Maps 等外部数据源的复杂任务。此次更新添加了“定时通知”技能,用于实现日常事务的自动化管理,并新增了持久化聊天记录功能,允许用户近乎即时地恢复长会话上下文。该平台依托开源工具包,积极鼓励社区开发者通过其 GitHub 仓库构建并分享专注实用的工作流、提示配置与工具集成。


推荐理由:MCP 终于跑在 Android 设备上了,虽然是实验性支持,但 Gemma 4 能直连 Workspace 和 Maps,做自动化的开发者可以上手试试。
00:39
Hacker News:AI 热帖精选
AI 评分 70/100
InsForge:面向编程智能体的一体化开源后端平台

InsForge是一个专为AI编码智能体设计的一站式开源后端平台。它通过MCP Server和CLI+Skills两种接口,让智能体能像后端工程师一样直接操作数据库、认证、存储、边缘函数、模型网关等全套后端服务,从而端到端地构建全栈应用。平台支持云托管与基于Docker的自托管,可一键部署至Railway、Zeabur等主流平台。


推荐理由:这个项目把后端全家桶变成 MCP 工具,AI 代理可以直接管理数据库和部署,对于正在折腾 agent 的团队,比东拼西凑要快得多。

5月19日5月19日周二

星期二 · 4 条
17:09
Claude:Blog(网页)精选
AI 评分 77/100
Claude智能体托管平台新增自托管沙箱与MCP隧道功能

Anthropic为其Claude智能体托管平台推出两项更新:自托管沙箱允许用户在自有基础设施或合作云平台上运行工具,确保敏感数据与服务保留在用户控制范围内;MCP隧道则通过轻量网关,使智能体能安全连接企业私有网络内的数据库与API,无需暴露于公网。目前沙箱功能已进入公测,隧道处于研究预览阶段。这两项更新进一步增强了企业用户对智能体执行环境与内部资源访问的安全管控能力。


推荐理由:自托管沙箱把agent执行挪到企业自己的基础设施里,敏感数据不再离开边界,这是让金融医疗等合规行业敢用AI agent的关键能力。MCP隧道补上了内网服务连接,组件已经完整。
08:00
Claude Platform:开发者版本说明(RSS)精选
AI 评分 72/100
Claude Platform 发布 MCP Tunnels 与托管智能体更新

Claude Platform 推出 MCP Tunnels 研究预览,支持连接私有网络内的 MCP 服务器。Claude Managed Agents 新增自托管沙箱选项,并支持在活跃会话中更新智能体的 MCP 服务器与工具配置。当工具输出超过 100K 字符(约 25K tokens)时,系统自动将完整内容溢出至沙箱文件,模型仅接收含文件路径的截断预览。


推荐理由:自托管沙箱和 MCP tunnels 是 Claude 平台向企业开发者伸出的橄榄枝,合规与内网连接痛点被明确回应,对生产环境部署是实质性补丁。
01:06
Anthropic:Newsroom(网页)精选
AI 评分 64/100
Anthropic收购SDK与MCP服务器工具开发商Stainless

Anthropic宣布收购SDK与MCP服务器工具开发商Stainless。Stainless自2022年成立以来,一直为Anthropic官方SDK的生成提供支持,其工具能将API规范转化为TypeScript、Python、Go等多语言的SDK、命令行工具及MCP服务器。此次收购旨在增强Claude平台的开发者体验,提升AI代理连接外部数据与工具的能力,从而在MCP协议基础上进一步拓展连接生态。


推荐理由:Anthropic收购Stainless,表面是SDK团队整合,深层是给Claude的Agent连接能力铺路。未来MCP服务器的质量和数量可能会跨一个台阶,做Agent开发的值得关注。

5月18日5月18日周一

星期一 · 1 条
10:45
IT之家(RSS)精选
AI 评分 70/100
腾讯 AI 设计智能体 Ardot 公测:一句话生成可编辑设计稿,一键转代码

腾讯云正式公测自研AI设计智能体平台Ardot。该平台核心功能包括:用户通过一句话指令即可生成App页面、官网、海报等可编辑设计稿;支持调用团队自有组件库生成规范稿,并能直接导入Figma文件保留原有设计。同时,Ardot具备设计稿一键转换为代码的能力,可对接CodeBuddy等开发工具实现代码还原。平台还提供多人在线实时评论、标注反馈和版本对比等协作功能,其微信小程序即将上线。


推荐理由:一句话生成可编辑设计稿不稀奇,但一键转代码加兼容 Cursor 这套组合拳让 Ardot 成了产设研协作的一个新选项,做项目和产品的可以上手试试。

5月15日5月15日周五

星期五 · 2 条
20:42
AYi@AYi_AInotes精选
AI 评分 76/100
飞书开源CLI工具45天获万星,AI操作可见可控引关注刚刚花三分钟装了飞书官方那个 CLI 工具, 跑了一句话,建群、建文档、发通知,一次性全做完了,我盯着终端看了几秒钟, 才反应过来这玩意儿真的能让 AI 直接操作飞书。装的过程没啥可说的, 一行 npx @larksuite/cli@latest install, 三分钟搞定,我试的场景挺日常,让 AI 帮我处理这么一件事, 明天上午十点和算法团队拉个会, 建一个会前准备文档, 把上周遗留的几个 issue 写进去, 然后在群里 @ 所有人通知时间,终端里它一步步在 print 自己要做什么, 建群、建文档、写入内容、发消息, 每一步都能用 --dry-run 先预览一遍再真的执行, 我作为人类全程能看清 AI 在干嘛,这跟我之前接 MCP 那种 AI 在云里自己执行你看不到的体感,完全不是一个东西,跑完我才回头去看 GitHub, 飞书这个 lark-cli 今天 star 数刚好破 1 万, 开源到现在 45 天, 平均每天 219 颗星,GitHub 的 star 跟微博点赞不一样, 每一颗都挂在一个真实开发者的账号上, 是国内办公套件里第一个、也是目前唯一一个破万星的开源项目, 但真正让我对这条新闻改观的, 是另一个被很多人划过去的数字,国内三家办公套件都开了 CLI,飞书、钉钉、企业微信, 只有飞书的主干里有 10 位真实外部开发者的代码被合进来,包括一个河南科大的实习生和一个土耳其的电商工程师,另两家是 0 和 0,星是路过给的, PR 是动手写的, 这两个指标的含金量差了一个量级。Notion 和 Figma 走的是 MCP 路线, 飞书选了 CLI,跑过一遍以后我有点理解这个选择了,AI 在 CLI 里执行任务, 每一步是可见的、可预览的、可审查的, 这个对开发者来说不是 fancy, 是真正能放心交给 Agent 去做事的前提,以后让 AI 帮我从拉会到归档跑完一个完整项目流, 可能真就是一句话的事啊。飞书开源命令行工具lark-cli在45天内获得超过1万GitHub star,成为国内首个破万星的办公套件开源项目。该工具允许AI通过命令行直接操作飞书,执行建群、建文档等任务,且每一步操作都可预览、可审查,与云端不可见的MCP模式形成对比。其主干代码已合并10位外部开发者的贡献,而同类产品钉钉和企业微信则为零。这种可见、可控的特性被视为开发者放心将任务交给AI Agent的前提,预示着一句话指令驱动完整项目流程成为可能。

推荐理由:飞书CLI把AI操作办公套件的每一步都摊在终端里,这种透明感是MCP黑箱给不了的,加上1万星和10个外部PR,这组数字比任何PR稿都诚实。