跳到正文

#GitHub

今日 0 条
8月18日周二
8月15日周六
  1. Hacker News 热门(buzzing.cc 中文翻译)50

    我把RSS订阅内容做成了电子墨水报,这样就不用再用手机看新闻了

    一位开发者用 RSS 阅读器 Feedbin 的 API 将未读订阅文章生成 e-pub 电子书,并加载到 4.3 英寸的 Xteink X4 电子墨水阅读器上,打造出专属的“电子墨水报”。该项目名为 feedpaper,已开源并可通过 Homebrew 安装,仅支持 macOS。作者表示借助 AI 的帮助,几分钟内就完成了构建。

8月14日周五
  1. HuggingFace Daily Papers(社区热门论文)66

    Alaya-EVOKE:从线性扩展监督到无尽世界

    Alaya Lab 等机构提出交互式世界模型 Evoke,通过外部相机索引世界状态库保持有界上下文,并重新设计教师模型以支持长时程监督。其稀疏注意力机制实现激活内存和计算量线性增长,30 秒长时程分布匹配目标使三步学生模型无需 CFG 即可抵抗内容漂移。

8月13日周四
  1. Hacker News 热门(buzzing.cc 中文翻译)58

    Hax——一款用 C 语言编写的原生终端极简主义编程工具

    Hax 是一款用 C 语言编写的极简主义终端编程工具,单个原生二进制文件,启动即时、内存占用仅几 MB,为本地 LLM 留出更多 RAM。它自动发现模型和运行时能力,支持 llama.cpp、OpenAI、Anthropic、Codex、OpenRouter 等提供商,并保留终端原生滚动缓冲。hax 运行于 Linux 和 macOS,可通过 Homebrew 安装或从源码构建。

  2. GitHub Blog67

    AutoGPT 如何用 AGENTS.md 和技能门控管理 AI 生成的拉取请求

    AutoGPT 维护者发现,AI 智能体不会主动阅读文档,因此将指令放在 AGENTS.md 和技能文件中,并置于代码目录旁。他们通过强制 PR 模板、测试计划、CI 覆盖率门槛和 CLA 签名等门控机制,将智能体提交的 PR 从“不可用”转变为“可用但不符合路线图”。其中 CLA 签名因需浏览器和 OAuth 流程,被用作区分人类与智能体的“人类探测器”。

    推荐理由:AutoGPT 的经验指出发现机制比文档完善度关键,agent 只读当前目录层级的指令,所以把 AGENTS.md 放在代码旁比继续写 wiki 更有效。

8月12日周三
  1. ByteByteGo(RSS)56

    GitHub、Vercel 与 Replit 如何应对 AI 代码生成商品化

    当 AI 模型能以极低成本快速生成可用代码,代码生成本身不再是开发者平台的差异化优势。GitHub 押注编排,通过 Agent HQ 在临时云环境中协调多家模型供应商的智能体;Vercel 押注生产路径,基于隔离 microVM 沙箱;Replit 则押注验证,用真实浏览器驱动的自测循环捕捉“看似能用”的代码。三家公司均支持 MCP 标准,让任意智能体接入任意工具。

  2. Hacker News 热门(buzzing.cc 中文翻译)71

    将 GitHub Copilot 置于中间人(MitM)代理之后后,我学到了什么

    作者通过 mitmproxy 对 VS Code 中的 GitHub Copilot 进行中间人代理拦截,逆向分析其网络流量与内部架构。文章指出这些 AI 应用普遍基于 Electron 构建,共享相似的网络栈,因此探测结果可迁移至其他同类应用。作者借此揭示了 Copilot 的运行时行为,并分享了配置代理的具体步骤。

    推荐理由:通过抓包与源码分析,文章展示 Copilot 如何把 .env 内容传至 API 并明文存储历史,阐释 AI 编码工具成为有状态系统后上下文既是产品也是风险源。

8月11日周二
  1. MiniMax (official)35

    MiniMax H3 开源视频模型发布首日即获 Sol Engine 加速,4.5 小时内实现端到端推理速度较 Diffusers 提升 3.95 倍、较 SGLang 提升 2.80 倍。加速方案结合内核融合、跨步缓存与 Sol-Attn 免训练稀疏注意力,无需蒸馏或微调。

    引用Enze Xie@xieenze_jr

    🚀 MiniMax H3, accelerated on Day 1 with Sol Engine! Within just 4.5 hours, our agent-native Sol Video Inference Engine achieved: ⚡ 3.95× end-to-end speedup over Diffusers ⚡ 2.80× speedup over SGLang 🎬 8× NVIDIA GB200, 1344×768, 24 FPS, 124 frames The acceleration combines kernel fusion and graph capture, cross-step caching, and training-free sparse attention powered by Sol-Attn—with no distillation, fine-tuning, LoRA, or offline calibration. We are especially excited to see a powerful open-weight model like MiniMax H3 released to the community. Open models are essential for pushing video generation research, systems optimization, and real-world deployment forward. We hope this is the beginning of a much more vibrant open-source video generation ecosystem—and Sol Engine will keep working to make the latest models faster and easier to deploy from day one. 🔗https://nvlabs.github.io/Sana/Sol-Engine/H3/

8月10日周一
  1. Qwen71

    👀 看见只是开始。 借助 Qwen-MM-Plugins,让你的智能体原生支持多模态——读取图片、视频和文档,编辑视频,处理 3D/CAD,以及更多。 从多模态模型 → 多模态智能体。🚀 观看实际效果:https://github.com/QwenLM/Qwen-MM-Plugins

    推荐理由:让智能体直接获得视觉、文档和 3D 感知能力,把原本需要单独集成的工作流变成一组可调用的插件,原型开发速度可能因此加快。

  2. Simon Willison 博客45

    GitHub Models 正式退役

    GitHub Models 已完成退役,其模型 playground 工具和跨 LLM 提供商的统一 API 服务正式关闭。该服务曾让 GitHub Actions 中的代码可直接使用环境内已有的 GitHub API key 执行提示词。作者已改用带月度消费限额的 OpenAI API key,并使用 GPT-5.6 Luna 生成 README 文件夹摘要。

8月9日周日
8月8日周六
  1. HuggingFace Daily Papers(社区热门论文)51

    KVAE:面向多模态生成模型的 tokenizer 系列

    KVAE 系列 tokenizer 覆盖音频、图像与视频,专为后续文本条件生成设计。其中 KVAE-Audio 为连续全频带 48 kHz tokenizer,具备 50 Hz 潜空间与 64 通道;KVAE-3D 提供 4x16x16 与 4x8x8 两种因果视频压缩方案;KVAE-2D 图像模型实现 8 倍压缩与 32 通道。

8月7日周五
  1. GitHub Blog69

    GitHub Copilot 应用中的斜杠命令使用指南

    GitHub Copilot 应用中的斜杠命令可帮助管理会话、导航项目和自定义 Copilot 工作流。与 CLI 版不同,应用版命令更侧重工作流,如 /plan 用于编码前规划、/spar 用于挑战方案假设、/autopilot 用于自动执行实现。/clear 和 /model 在 CLI 和应用中均可用。

    推荐理由:文章不是罗列命令,而是提供了可复用的场景模板,为 /plan、/spar 等命令配好了规划、评审和实现的具体提示词,省去从零组织任务描述的时间。

8月6日周四
  1. HuggingFace Daily Papers(社区热门论文)57

    HelloWorld:让视频世界模型中的角色实现社交互动

    HelloWorld 是一个支持用户与视频世界内角色进行社交互动的视频世界模型。用户只需按一次按钮,即可让屏幕中的角色转向镜头、挥手、点头或说出简短问候。该模型通过自蒸馏流程微调视频生成模型,并引入无需训练模块调节 DiT 交叉注意力掩码,以时间定位角色响应。

8月5日周三
  1. HuggingFace Daily Papers(社区热门论文)67

    JoyAI-Video-Edit:基于自回归扩散的实时开放式视频编辑

    京东探索研究院联合香港大学等机构推出JoyAI-Video-Edit,一个16B参数的自回归扩散框架,支持无需预设时长、不依赖未来帧的实时开放式视频编辑。该系统在单块Nvidia B200 GPU上实现约30 FPS的端到端视频编辑,自动与人工评测显示其显著优于现有流式编辑器,并与强离线系统相当。

  2. GitHub Blog45

    GitHub 法务团队如何用 Copilot CLI 简化工作流程

    GitHub 法务团队的非工程师成员(律师、项目经理、业务人员)用 Copilot CLI 构建了内部工具。产品法律顾问 Ngandu Kasuku 创建了合同起草工具 terms-ai,将审查和起草时间缩短约一半;在线安全法律顾问 Jesse Geraci 构建了法律工作流桌面应用,涵盖合同审查、NDA 分类、风险评估等。工具核心指令以纯语言 Markdown 编写,便于非技术人员定制。

  3. GitHub Blog67

    GitHub 如何用堆叠式 Pull Request 拆解 AI 生成的巨型代码

    GitHub 介绍用堆叠式 Pull Request(stacked PR)解决 AI 编码智能体生成巨型代码难以审查的问题。通过将 1,000+ 行的大 diff 按数据、API、接线、UI 拆成 L1-L4 四个独立分层,每层可分配不同审查者。

    推荐理由:详细演示了用 GitHub 堆叠 PR 将 AI 生成的大 PR 拆分为逻辑层,配合 gh-stack CLI 和技能,提供可立即采用的审查优化方案。