Google 开源 Mantis,一套协议无关的安全审查技能包,可让现有编码智能体跑完漏洞全生命周期,包括发现疑似缺陷、过滤误报、在 gVisor 或禁网 VM 沙箱中复现、写最小补丁并对补丁再攻击、给出 1 到 10 的风险评分。
Google 开源 Mantis,一套协议无关的安全审查技能包,可让现有编码智能体跑完漏洞全生命周期,包括发现疑似缺陷、过滤误报、在 gVisor 或禁网 VM 沙箱中复现、写最小补丁并对补丁再攻击、给出 1 到 10 的风险评分。
Vercel Labs 发布实验性语法高亮工具 gpu-lexer,用 27.4KB 的 WebGPU 模型对任意语言源码做 token 标注,无需按语言选择语法。在 5.56M 字符输入上高亮耗时 402ms,快于 Prism.js 和 Shiki;在留出文件上与 Shiki 的标注一致率为 88.02%,Top-25 加权一致率 90.35%,作者强调这是实验而非语法等价的高亮器。
TradingAgents 是一个模仿真实交易公司分工的多智能体 LLM 金融交易框架,已完全开源,最新 v0.4.0 修复了 FRED 宏观、社交情绪和决策日志中的未来函数问题,并支持 GPT-5.6 和 GLM-5.3。
Berkeley RDI 推出开源平台 CUA-Lite,为计算机使用智能体提供三个标准化抽象。其环境接口下运行 15+ 个覆盖桌面、浏览器和移动端的基准,并提供含 30k+ 可验证任务的免 VM 桌面沙箱;统一监督数据格式已转换 10+ 个公开 CUA 数据集;每模型一个 harness 在评测、SFT 和 RL 间共享,支持 14 个模型族。
We used TeamAI-CLI internally at Tencent since March. Open sourced it. It turns team knowledge into one git repo, so eve...
UC Berkeley 团队发布开源平台 CUA-Lite,将 computer-use agents 所需的智能体、环境、轨迹数据与训练评测统一到一套动作空间、LiteSample 数据格式和单一命令之下,覆盖桌面、浏览器与移动端。
Anthropic 发布基于 Lean 4.33.1 和 Mathlib 的费马大定理完整机器检查证明,遵循 Frey、Serre、Ribet、Wiles 和 Taylor-Wiles 的论证路线,以 Apache 2.0 开源。
同一事件,精选展示《Claude 用 11 天完成费马大定理的首个完整机器验证证明》Inspired by the cool release of Atlas from @theworldlabs, a Friday-night hack: re-shoot an existing video from a camera ...
Anthropic just uploaded a Lean 4 proof for Fermat's last Theorem https://github.com/anthropics/fermats-last-theorem
同一事件,精选展示《Claude 完成 Fermat 大定理的形式化证明,生成超 1300 万行 Lean 代码》I’ve officially open-sourced ABYSSAL. 🌊⚡ ABYSSAL is a fully procedural ocean and extreme-weather experience that runs d...
Anthropic 发布 anthropics/commerce-agents 开源参考蓝图,包含购物智能体和商家智能体各 5 项技能,以及零售、旅游、电信、娱乐四个可运行垂直场景。
Nvidia 发布免费开源软件 Personal AI Router(PAIR),可发现并连接网络中的兼容电脑,配合 Ollama、LM Studio 等工具处理本地 AI 推理和智能体工作流。PAIR 并非硬件路由器,兼容 RTX 20 系列及更新的 GeForce GPU、RTX Pro GPU、DGX Spark 系统,也支持 Apple M4 或更新芯片。
另有 3 家信源报道MarkTechPost(RSS)The Decoder:AI News(RSS)IT之家(RSS)最近在YouMind Skills 社区里感受到的很多惊喜: 1.小小东老师的绝美的设计Skills https://youmind.com/zh-CN/skills/bio/8fbcfbe5-b757-45b8-b292-224756ff...
Perplexity 开源了支撑其 Hybrid Compute 的本地推理引擎 Lily,用 Rust 驱动生成循环、手写 Metal kernel 执行模型,不依赖 PyTorch 或 MLX,仅针对 Qwen3.6-35B-A3B 这一个模型。
Hacker News 热帖分享 WebLLM,一个高性能的浏览器内大语言模型推理引擎,项目托管在 GitHub(github.com/mlc-ai/web-llm),当前获得 100 HN points。
fable51-worlds 项目发布由自主 Claude Fable 5.1 智能体集群端到端研究、建模并质检的真实街区重建,以纯 Three.js 应用交付,无需游戏引擎或专有 3D 格式。
Qwen 开发者团队发布开源工具 zg(zvec-grep),将 ripgrep、BM25 与向量搜索统一到一个本地优先接口,代码以 Apache 2.0 许可发布在 zvec-ai GitHub 组织下,可通过 npm 安装 @zvec/zvec-grep,需 Node.js 22+,默认模型无需 GPU。
如何搭建能干活的会议Agent|构建第二大脑🧠 最近我搭建了一个能直接帮我干活的会议Agent 的助手🤖 😄每一次 无论是公司的开会 还是个人和朋友的交谈录音 结束之后 我的 Agent 都会自动捕捉到逐字稿 帮我存入到第二大脑中 分...
腾讯混元发布 Hy4 preview 轻量量化版,用自研 Sherry 稀疏三值量化算法(平均 1.25 bit)和 MIX-STQ1_0 逐层混合精度策略,把约 1.5 TB 的权重压到约 214 GB。
Graham Dumpleton(mod_wsgi 与 New Relic Python agent 作者)发布 Wrapture,可包装任意函数或方法以实现追踪或覆盖返回值,既可替代 unittest.mock,也可为现有项目加追踪,内置 OpenTelemetry 支持和纯配置式追踪机制。
Just days after the v1.0 release, OpenMAIC climbed to #1 on GitHub Trending—and the momentum hasn’t stopped. 🚀 Now past...
一款针对 Silicon Motion SM750 显卡的全新开源 Linux HDMI DRM 驱动发布,支持 SE-DP750A-HDMI PCIe 板卡,可输出 2048 宽硬件模式或软件缩放的 2560x1080 超宽桌面。
OpenClaw 2.0(v2026.8.1)正式发布,由 933 位贡献者共同完成,包含超过 16,000 个拉取请求。新版本重点简化了安装流程,新用户可从现有 AI 服务订阅、API 密钥或本地模型入手,并可通过与 Claw 对话完成后续配置。浏览器应用体验获重塑,用户可随时继续设置或实时参与。
另有 3 家信源报道The Decoder:AI News(RSS)MarkTechPost(RSS)Hacker News 热门(buzzing.cc 中文翻译)At Reactor we ❤️ open-source. We teamed up with @haoailab to ship an infinite live stream powered by FastVideo’s FastH3:...
vLLM v0.28.0 发布,包含 584 个提交,来自 270 位贡献者。该版本为 Kimi-K3 带来 DCP 支持、融合 FlashKDA 内核及约 60% 的 DSpark TTFT 改进,并为 DeepSeek V4 实现端到端稀疏 MLA。
This is INSANE! To date @openclaw has had 106 stable releases and this release alone accounts for roughly 49% of ALL PRs...
StemDeck 是一款免费、开源且完全本地运行的茎叶分离工具,无需账号、上传或订阅,可将 MP3、WAV、FLAC 等音频或 YouTube 链接分离为人声、鼓、贝斯、吉他、钢琴等最多 6 个音轨。
LAION 发布 Big Video Dataset(BVD),从 CommonCrawl 的 13 亿视频 URL 中下载了 8000 万个视频,总计 1000 万小时,并提取了 5500 万个带自动生成描述的视频片段和 3 亿张静态图像。
开发者 Jordy Zomer 在漏洞研究中使用 LLM 智能体时发现,模型会逐渐丢失已确认的结论并产生幻觉。他借鉴程序分析思路,构建了 Lemmalog——一个面向 LLM 的 Datalog 引擎,将模型负责的模糊信息提取与确定性的规则推导分离。当某个观察事实被推翻时,引擎能自动使依赖它的结论失效,无需模型重新推理。