Topic · 主题全部主题 →

AI 编码

AI 写代码的一切:编码助手、Vibe Coding、代码模型评测与开发工作流变革。

5,063条收录
582条精选

精选归档 · 第 16 页

301320 条 · 共 582

6月1日6月1日周一

星期一 · 1 条
11:39
MiniMax:Blog(网页)精选
AI 评分 83/100
MiniMax M3:前沿编码、100万token上下文与原生多模态一体模型

MiniMax M3 是一个开源前沿模型,具备先进的编码与AI智能体能力。它支持100万token的超长上下文窗口,并采用名为MSA(MiniMax Sparse Attention)的新型稀疏注意力架构。该架构使模型在100万token上下文下的每token计算成本降至前代的1/20,预填充速度提升9倍以上,解码速度提升15倍以上。在SWE-Bench Pro编码基准上,MiniMax M3得分59.0%,超越GPT-5.5和Gemini 3.1 Pro,性能接近Opus 4.7。该模型可通过MiniMax Code、Token Plan和API服务使用。


推荐理由:MiniMax M3 把开源模型的编码能力推到了 GPT-5.5 和 Opus 4.7 这条线上,还附带 1M 上下文和原生多模态,这是开源社区真正能打的前沿选项,做 Agent 的值得立刻跑一下。

5月31日5月31日周日

星期日 · 1 条
23:44
Tibo@thsottiaux精选
AI 评分 65/100
Codex用量限制已重置,可尽情使用The Codex usage limits have been reset for all paid ChatGPT subscriptions. You should be back to 100% weekly and 100% hourly limits.Let the tokens do incredible things today and have fun.所有付费ChatGPT订阅用户的Codex使用限制已重置。您现在应恢复至每周100%和每小时100%的限额。 让token今天创造不可思议的事,玩得开心。

Tibo: Five million users would agree. Resetting the limits tomorrow morning to celebrate. Time to go /fast


推荐理由:Codex 额度重置对重度用户是刚需信号,之前频繁撞墙的痛点被解决,今天可以放心跑长任务。虽然只是策略调整,但比多数模型更新更实在。

5月30日5月30日周六

星期六 · 5 条
06:49
Greg Brockman@gdb精选
AI 评分 75/100
Codex可自主管理对话线程与并行任务codex for managing the codex UI:Codex用于管理Codex界面: 【引用 @guinnesschen】:如果你厌倦了管理Codex对话线程,就让Codex自己管理自己吧!Codex现在可以创建对话线程、搜索它们、整理它们、固定重要的线程,并为并行任务启动工作树。

Guinness Chen: If you ever get tired of managing your Codex threads, just let Codex manage itself! Codex can now create threads, search...


推荐理由:Codex 能自己管理线程、搜索、组织了,长期在终端里干活的开发者会明显减少上下文切换,这是把 AI 助手往主动管理推了一步。
02:49
Greg Brockman@gdb精选
AI 评分 71/100
Codex Windows端重大升级,支持计算机操作与移动端协同Significant upgrades for Codex users on Windows:Codex 用户在 Windows 上迎来重大升级: 现在计算机操作功能已在 Windows 上可用,Codex 可以在你的 Windows 电脑上执行操作。 同时,ChatGPT 移动应用中的 Codex 也支持 Windows,让你可以随时随地启动、审查和引导任务,而工作则在你的 Windows 机器上继续进行。 这是一次早期体验,但我们正在努力提供更多方式,让你无论身在何处都能保持工作推进。

OpenAI: Windows users, this one’s for you. Computer use now works on Windows, so Codex can take action on your Windows computer....


推荐理由:Codex终于能在Windows上操控电脑了,搭配手机App就能远程指挥任务,这对用Windows写代码的开发者是个实用升级,虽然还是早期体验,但跨设备协同的雏形已经出来了。
00:09
xAI@xai精选
AI 评分 73/100
xAI 发布 Grok Build 0.1 公测版grok-build-0.1 is now available via the xAI API in public beta.This is the same model that powers the Grok Build CLI and excels at agentic coding.Priced at $1/m input and $2/m output, it’s extremely cost effective, intelligent, and fast.grok-build-0.1 现已通过 xAI API 提供公开测试版。 这是驱动 Grok Build CLI 的同一模型,擅长智能体编码。 定价为输入 $1/m,输出 $2/m,极具成本效益、智能且快速。
另有 4 家信源报道X:Elon Musk (@elonmusk, xAI)X:阿易 AI Notes (@AYi_AInotes)X:SpaceXAI (@SpaceXAI)X:Testing Catalog (@testingcatalog)
推荐理由:xAI 把 Grok Build 底层模型开放 API 了,定价比竞品便宜一个量级,做 agentic coding 的可以低成本试一下,速度也不错。

5月29日5月29日周五

星期五 · 5 条
19:10
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 73/100
Claude Code--文档中未提及的所有可配置选项

该篇文章标题涉及“Claude Code”的可配置选项,但提供的正文内容仅包含一张图片和一个外部链接,未给出任何关于模型版本、参数、性能、价格或功能的具体信息。根据规则,无法在摘要中提及原文不存在的细节。


推荐理由:如果你在用 Claude Code,这份从源码里扒出的隐藏配置清单能让你摆脱默认模式,好多选项官方文档压根没提。
03:22
MiniMax (official)@MiniMax_AI精选
AI 评分 76/100
MiniMax M2.7 免费智能体编程限时开放Free agentic coding with MiniMax M2.7 on @OpenHandsDev?Yes, please! Available for a limited time ⚡👀在 @OpenHandsDev 上使用 MiniMax M2.7 进行免费智能体编程? 是的,请给我!限时提供 ⚡👀

OpenHands: We have also partnered with @MiniMax_AI to provide *free access to agents with MiniMax-M2.7* for a limited time! This is...


推荐理由:MiniMax把M2.7免费接到OpenHands里跑Agent编码,而且限时,这对个人开发者是实打实的免费用机会,不妨上去跑几个任务体验下性价比。
02:42
xAI:News(网页)精选
AI 评分 82/100
Grok Build 0.1 on API

xAI 的最新编码模型 Grok Build 0.1 已通过 xAI API 进入公开测试阶段。该模型专为智能体编码任务训练,支持网页开发、调试和 MCP,同时也是驱动 Grok Build CLI 的同一模型。其推理速度超过 100 tokens/秒,定价为输入 $1/m tokens,输出 $2/m tokens。除编码外,它也适用于通用智能体及工具调用场景,并可通过 OpenRouter 和 Vercel AI Gateway 获取。

另有 4 家信源报道X:Elon Musk (@elonmusk, xAI)X:阿易 AI Notes (@AYi_AInotes)X:SpaceXAI (@SpaceXAI)X:Testing Catalog (@testingcatalog)
推荐理由:xAI 把编码模型卷到了 100+ t/s 和 $2/M 输出,专攻 agentic coding,这是直接在叫板 Claude Code 和 Cursor,做开发工具的同行该重新算账了。
01:21
Claude:Blog(网页)精选
AI 评分 78/100
在Claude Code中引入动态工作流

Claude Code 推出“动态工作流”功能,使 Claude 能端到端处理复杂任务。该功能通过动态编写脚本,在单个会话中并行运行数十到数百个子智能体来完成工作,并会在结果呈现前进行验证。它适用于跨代码库的 bug 查找、大规模迁移(如将 Bun 从 Zig 移植到 Rust)等需要多角度分析的任务。该功能现已在研究预览阶段可用,支持 Claude Code CLI、桌面端、VS Code 扩展以及 API、Amazon Bedrock、Vertex AI 等平台,面向 Max、Team 及已启用的 Enterprise 计划用户。

另有 4 家信源报道X:Thariq (@trq212)X:Claude Devs (@ClaudeDevs)Claude:Blog(网页)Claude Code:GitHub Releases(RSS)
推荐理由:动态工作流第一次让 Claude Code 能独立搞定需要并行协调的大规模工程任务,Bun 从 Zig 到 Rust 只用了十一天,这对复杂代码库的维护和迁移是降维打击。
01:05
Anthropic:Newsroom(网页)精选
AI 评分 85/100
Claude Opus 4.8 发布:在编码、智能体技能与推理方面实现全面升级

Anthropic 发布了新一代模型 Claude Opus 4.8,作为 Opus 4.7 的升级版本,其在编码、智能体技能、推理和实用知识工作等各项基准测试中均取得进步。Claude Opus 4.8 现已可用,价格与前代相同。同步推出的新功能包括:用户可控制任务投入程度、Claude Code 新增“动态工作流”特性,以及 Opus 4.8 的 2.5 倍速模式价格降低为以往的三分之一。早期测试者反馈其在智能体任务中的判断力更可靠、工具调用更高效。该模型在 Online-Mind2Web 测评中得分 84%,超越了 Opus 4.7 和 GPT-5.5。此外,其诚实度与对齐表现也得到提升,代码错误漏检率降低了约 75%。


推荐理由:Opus 4.8看着是常规升级,但动态工作流让Claude Code能啃下跨十万行代码迁移这种硬骨头,快速模式降价三倍更是直接拉低了实时场景的入场券。

5月28日5月28日周四

星期四 · 3 条
11:15
IT之家(RSS)精选
AI 评分 73/100
英伟达推出 AI 框架 Polar,让 Codex 跑分暴涨 594.74%

英伟达研究团队开源了智能体强化学习框架 Polar。该框架无需重写现有智能体执行框架(如 Codex CLI、Claude Code、Qwen Code、Pi),通过在模型 API 边界放置智能体来接入 GRPO 训练。实验显示,基于 Qwen3.5-4B 模型,Polar 将 Codex 在 SWE-Bench Verified 上的 pass@1 分数从 3.8% 提升至 26.4%(增涨 594.74%)。效率上,其 prefix_merging 技术将训练步骤从 1185 次降至 218 次,速度提升约 5.39 倍,GPU 平均利用率从 20.4% 升至 87.7%。


推荐理由:Polar 把 Codex 的 SWE-Bench 分数从 3.8% 拉到 26.4%,不是靠新模型而是靠训练框架,做代码 agent 的团队可以直接用,开源即拿即训。
01:35
Simon Willison 博客精选
AI 评分 72/100
我认为 Anthropic 和 OpenAI 找到了产品市场契合点

Anthropic 与 OpenAI 通过编程智能体找到了产品市场契合点,这导致企业客户成本显著上升。两家公司已于 2026 年 4 月前后调整了企业套餐定价,从原先的高额折扣改为与 API 用量挂钩。Anthropic Enterprise 套餐变为每席位 20 美元/月外加 API 费用,OpenAI Codex 则按 API token 用量计费。同期发布的新模型 GPT-5.5(4月23日)和 Opus 4.7(4月16日)的 API 定价也显著高于前代版本。

另有 1 家信源报道Hacker News 热门(buzzing.cc 中文翻译)
推荐理由:Simon 这篇把近期碎片线索串起来了,企业级定价变化加上代码代理消耗剧增,说明 Anthropic 和 OpenAI 可能真开始赚钱了,四月是个新拐点。
00:30
xAI@xai精选
AI 评分 69/100
Grok编程智能体登陆Kilo IDE平台Use your SuperGrok or X Premium+ subscription in @kilocode.Try grok-build-0.1 for high speed and agentic coding intelligence, available in the Kilo IDE extensions or CLI.https://x.ai/news/grok-kilocode在 @kilocode 中使用您的 SuperGrok 或 X Premium+ 订阅。 尝试 grok-build-0.1,享受高速和智能体编程智能,可在 Kilo IDE 扩展或 CLI 中使用。 https://x.ai/news/grok-kilocode另有 4 家信源报道X:Elon Musk (@elonmusk, xAI)X:阿易 AI Notes (@AYi_AInotes)X:SpaceXAI (@SpaceXAI)X:Testing Catalog (@testingcatalog)
推荐理由:xAI 把 grok 的编码模型塞进 Kilo Code,如果你本来就用这两个工具,这次集成能省不少事,但算不上行业震动。

5月27日5月27日周三

星期三 · 4 条
09:58
公众号:数字生命卡兹克精选
AI 评分 65/100
从0到1速通OpenAI Codex:安装、设置与实操教程

近日OpenAI的AI智能体Codex热度飙升。教程涵盖完整使用流程:从官网下载安装,支持从Claude Code和Cowork一键导入配置;界面分对话区和项目区,权限可选默认、自动审查或完全访问;模型推荐GPT-5.5,推理等级用高或超高,速度可选快速(1.5倍速度、2倍token消耗)或标准;建议开启引导模式、记忆功能,并设置全局AGENTS.md规则(卡帕西模板);通过Skills和插件管理扩展能力;演示了开发网页(使用计划模式、批注功能圈选修改)和开发用药提醒App(需安装Xcode编译到手机)。


推荐理由:如果你还在观望要不要入坑Codex,这篇保姆级教程把安装、设置、开发网页到打包APP全流程踩了一遍,那个@Computer Use帮你装Xcode的操作一看就懂,想动手的现在就能跟做。
09:33
Claude Code:GitHub Releases(RSS)精选
AI 评分 71/100
Claude Code v2.1.152 更新发布

Claude Code 发布 v2.1.152 版本更新。核心改进包括:/code-review --fix 现在会将审查建议直接应用于工作目录;技能与斜杠命令支持通过 frontmatter 的 disallowed-tools 移除模型工具;新增 /reload-skills 命令可不重启会话重新扫描技能目录;SessionStart 钩子现可返回 reloadSkills: true 重新扫描技能,并可通过 hookSpecificOutput.sessionTitle 设置会话标题;新增 MessageDisplay 钩子事件以变换或隐藏助手消息。其他更新涉及插件市场管理、主模型不可用时自动切换至 --fallback-model、会话用量统计优化等。同时修复了终端样式退化、沙箱警告显示、思考摘要、MCP 服务器去重、远程会话连接及多种会话卡顿问题。


推荐理由:Claude Code 这次更新把代码审查从'查问题'推进到'直接修',Skills 系统补上了热加载和工具限制,做工程自动化的团队应该立刻更新。
09:31
Qwen@Alibaba_Qwen精选
AI 评分 68/100
Qwen3.7-Max代码竞技场排名第四,与Claude Opus 4.6持平🚀🚀 Qwen3.7-Max just hit #4 on Code Arena, on par with Claude Opus 4.6 ,top-ranked Chinese lab on the board! @arenaMore to ship. Stay tuned. 🕶️🚀🚀 Qwen3.7-Max 刚刚在 Code Arena 上升至第 4 名,与 Claude Opus 4.6 持平,是榜单上排名最高的中国实验室!@arena 更多内容即将发布。敬请期待。🕶️

Arena.ai: Qwen3.7 Max (20250517) debuts at #4 in Code Arena: Frontend - the top-ranked Chinese lab on the board, surpassing GLM-5....

另有 9 家信源报道X:阿里云 / Alibaba Cloud (@alibaba_cloud)公众号:通义实验室(千问)X:通义千问 / Qwen (@Alibaba_Qwen)X:X.PIN (@thexpin)Qwen:Blog Retrieval(API)X:OpenRouter (@OpenRouter)Hacker News 热门(buzzing.cc 中文翻译)IT之家(RSS)X:Rohan Paul (@rohanpaul_ai)
推荐理由:Qwen3.7-Max 在 Code Arena 前端任务上排第四,跟 Claude Opus 4.6 打平,国产模型第一次在 agentic web dev 摸到第一梯队,做 Web Agent 的可以认真看看。

5月26日5月26日周二

星期二 · 1 条