Cursor 发布 Self-Hosted Machines,让云智能体的工具执行迁移到企业自有网络内的机器,智能体循环、推理和规划仍留在 Cursor 云端,通过 worker 的出站 HTTPS 连接对接,Cursor 不会主动连入企业网络。
AI 编码
AI 写代码的一切:编码助手、Vibe Coding、代码模型评测与开发工作流变革。
精选归档 · 第 2 页
第 21–40 条 · 共 580 条
9月3日
Anthropic 发布构建电商智能体的指南,总结架构、延迟与成本优化、生产运维三部分实践,涉及购物和商家两类智能体,企业客户部署后出现购物车变大和卖家运营效率提升。核心建议包括用单个智能体加技能而非子智能体、将 UI 组件做成工具、用提示词缓存实现 90-99% 命中率、在 harness 中强制安全规则,并开源参考实现 anthropics/commerce-agents。
另有 1 家信源报道Claude:Blog(网页)9月2日
Google DeepMind 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber。
另有 19 家信源报道X:fofr (@fofrAI)Ars Technica:AI(RSS)X:Elvis Saravia (@omarsar0, DAIR.AI)MarkTechPost(RSS)X:Google DeepMind (@GoogleDeepMind)The Decoder:AI News(RSS)IT之家(RSS)X:Artificial Analysis (@ArtificialAnlys)X:Ammaar Reshi (@ammaar)X:Gemini (@GeminiApp)X:Logan Kilpatrick (@OfficialLoganK)X:Sundar Pichai (@sundarpichai)X:Testing Catalog (@testingcatalog)X:Josh Woodward (@joshwoodward, Google Labs VP)X:Demis Hassabis (@demishassabis)X:OpenRouter (@OpenRouter)X:Rohan Paul (@rohanpaul_ai)X:Google AI (@GoogleAI)Hacker News 热门(buzzing.cc 中文翻译)Google 员工 Shir Meir Lador 介绍 harness 工程,即用确定性组件包裹 LLM,包括编排层、执行沙箱、状态持久化和验证工具,让 Agent 不需逐行人工审查即可安全生成代码。
LongCat-2.0 现在在 Cline 中免费开放使用。 这是一款 1.6T 参数的开源权重 MoE 模型,拥有 1M 上下文窗口,来自 @Meituan_LongCat,得分与 Claude Opus 4.7 和 Gemini 3.1...
UU远程于9月2日上线新版本,重点优化终端功能,补齐 TUI 渲染交互与终端会话管理能力。主要更新包括:Mac 免密码登录、移动端输入优化并新增调用系统输入法的独立输入框、可同时创建和管理多个终端会话并支持手机与电脑间跨端同步接管(通过 uuyc-cli lterm 命令)。
Qwen3.8-Max-0902 由 @Alibaba_Qwen 发布,刚刚在 Code Arena: WebDev 中以 1,691 分的成绩登顶总榜第一,并以混合 $5/MToken 的价格成为 Pareto 前沿上得分最高的模型! 在...
另有 5 家信源报道IT之家(RSS)X:Kim (@kimmonismus)X:通义千问 / Qwen (@Alibaba_Qwen)X:阿易 AI Notes (@AYi_AInotes)X:阿里云 / Alibaba Cloud (@alibaba_cloud)Anthropic 发布 Claude Fable 5.1 和 Claude Mythos 5.1,两者为同一模型但安全防护级别不同,Mythos 5.1 仅通过可信访问计划提供给网络安全和生命科学领域的受审机构。
另有 4 家信源报道The Verge:AI(RSS)X:Testing Catalog (@testingcatalog)MarkTechPost(RSS)IT之家(RSS)Anthropic 发布 Claude Fable 5.1(claude-fable-5-1),面向长时间运行的智能体编码、知识工作与研究,Claude Mythos 5.1 面向 Project Glasswing 参与者。
另有 11 家信源报道X:Thariq (@trq212)Hacker News 热门(buzzing.cc 中文翻译)X:Boris Cherny (@bcherny)X:Claude (@claudeai)X:Testing Catalog (@testingcatalog)X:小北 (@frxiaobei)The Decoder:AI News(RSS)MarkTechPost(RSS)TechCrunch:AI(RSS)The Verge:AI(RSS)IT之家(RSS)We’re introducing Claude Fable 5.1 and Claude Mythos 5.1. They're the world’s most advanced models for coding and knowle...
另有 13 家信源报道X:Testing Catalog (@testingcatalog)MarkTechPost(RSS)The Verge:AI(RSS)IT之家(RSS)X:OpenRouter (@OpenRouter)X:Kim (@kimmonismus)X:Thariq (@trq212)Hacker News 热门(buzzing.cc 中文翻译)X:Boris Cherny (@bcherny)X:Claude (@claudeai)X:小北 (@frxiaobei)The Decoder:AI News(RSS)TechCrunch:AI(RSS)8月30日
https://x.com/i/article/2090828118454071296
8月29日
智谱宣布开源 GLM-5.3 模型权重,支持本地运行与个性化定制,擅长复杂编码、防御性网络安全及长程任务。该模型在 AA 综合智能指数中取得 60 分,与 Claude Fable 5、GPT-5.6 Sol 等闭源旗舰同级,并与 Kimi K3 并列开源模型第一。仅年营业额超 100 亿美元的机构将其作为外部模型服务提供时才需安全审查。
我们正在终止与 Cursor 的合作关系,原因是其被 SpaceX 收购。根据我们的提议,Cursor 对我们模型的直接访问权限将于 11 月 12 日结束。 我们知道,受此决定影响最大的是那些在 Cursor 中依赖 OpenAI 模型的...
另有 9 家信源报道X:Kim (@kimmonismus)X:OpenAI (@OpenAI)The Decoder:AI News(RSS)Hacker News 热门(buzzing.cc 中文翻译)IT之家(RSS)X:Rohan Paul (@rohanpaul_ai)X:Testing Catalog (@testingcatalog)X:Yuchen Jin (@Yuchenj_UW)X:小北 (@frxiaobei)OpenAI 已通知 SpaceX,将终止向 Cursor 提供 OpenAI 模型的合同,拟定关停日期为 2026 年 11 月 12 日,并给予合同允许的最长通知期。OpenAI 称此举源于无法确信 SpaceX 会遵守服务条款,并援引马斯克旗下公司此前违反合同及 xAI 违反 OpenAI 服务条款的先例。OpenAI 表示将尽力支持受影响的开发者过渡。
另有 6 家信源报道X:Kim (@kimmonismus)X:OpenAI (@OpenAI)X:阿易 AI Notes (@AYi_AInotes)The Decoder:AI News(RSS)IT之家(RSS)X:Yuchen Jin (@Yuchenj_UW)8月28日
8月25日
GPT-5.6 模型家族现已登陆软件开发智能体 Kiro,包含 Sol、Terra 和 Luna 三款模型。在 Terminal-Bench 2.1 测试中,GPT-5.6 Terra 在 Kiro 内完成任务成本降低约 82%。该更新由 OpenAI 与 AWS 合作优化,旨在以更少迭代和更高 token 价值帮助开发者产出更高质量的代码。
8月21日
Anthropic 发布 AI 原生 SDLC 实战手册,提出将传统六阶段软件开发生命周期重构为 AI 嵌入各环节的闭环流程。手册指出,当代码不再是瓶颈时,规划、审查、部署等人速环节成为新约束,需通过 Claude 将需求压缩为 intent.md、以技能编码标准、用持续评测替代阶段门禁,并保留人工对关键代码的审查。
8月20日
Anthropic 发布面向初创公司的 Claude Code 使用指南,基于对十余家高增长公司的调研,总结出“人人皆可交付、自动化繁琐工作、信任但验证、为重构而构建、原型-自用-产品化”五大规则。
8月19日
百度千帆今日上架智谱开源旗舰模型GLM-5.3,API定价与智谱官方保持一致。该模型与上代同架构、同参数,依靠后训练Scaling在代码与网络安全能力上表现超预期,AA综合智能指数取得60分,与Kimi K3并列开源模型第一。开发者可通过API调用或订阅Token Plan企业版接入Claude Code等AI工具使用。
GLM-5.3 API即日上线,擅长复杂编码、防御性网络安全与长程任务,在AA综合智能指数中取得60分,与Claude Fable 5、GPT-5.6 Sol等闭源旗舰同级,并与Kimi K3并列开源模型第一。该模型以更小参数规模和更低调用成本降低前沿智能门槛,单任务成本为旗舰模型中最低。API定价与GLM-5.2持平,模型权重将于下周五开源。
另有 5 家信源报道X:X.PIN (@thexpin)The Decoder:AI News(RSS)IT之家(RSS)X:Artificial Analysis (@ArtificialAnlys)X:智谱 Z.ai (@Zai_org)