2026年9月16日
fx:把 coding agent 做成一把瑞士军刀
fx 是一个用 Zig 写的原生 coding agent,二进制只有 6MB 出头。它能当终端 agent 用,也能作为 WASM 内核嵌进浏览器和 Node 应用。这篇文章拆解它的工具、权限、子 agent、上下文和嵌入设计,以及它和主流 coding agent 的差别。
2026年9月16日
fx 是一个用 Zig 写的原生 coding agent,二进制只有 6MB 出头。它能当终端 agent 用,也能作为 WASM 内核嵌进浏览器和 Node 应用。这篇文章拆解它的工具、权限、子 agent、上下文和嵌入设计,以及它和主流 coding agent 的差别。
2026年9月15日
OpenCodeReview 在 GitHub Today 获得 +1,796 stars,并于同日发布 v1.12.1。它不是让 Agent 自由浏览代码,而是把文件选择、规则匹配、分组和评论校验交给确定性程序,再把真正需要判断的部分留给模型。
2026年9月13日
Codex 的 apply_patch 不只是把几行文本写回文件。本文从 Patch、diff 和 hunk 讲起,逐层拆解它的语法、解析、上下文匹配、预验证、权限评估、文件系统执行与部分失败边界。
2026年9月12日
PI-Desktop 在 GitHub Today 拿到 +545 stars,当天又发布 v0.14.7-beta.1。它把多模型、技能、MCP、子 Agent 和权限确认收进本地桌面,但仍是一款需要审慎安装的早期预览软件。
2026年9月11日
i-have-adhd 没有增加模型能力,只重排回答顺序。它在 GitHub Today 当日拿到 +3,854 stars,把“先行动,后解释”做成了一份可安装的 Agent Skill。
2026年9月7日
Humanizer v3.0.0 登上 GitHub Trending。它不靠“检测 AI”,而是把空泛铺垫、模板节奏、借来的权威与聊天残留分开检查,同时要求改写不能补造事实。
2026年9月7日
承接 dsh-zvec-grep 的开发,聊聊 pi-zvec-grep 如何在命令行 Agent 中自动建立和更新代码索引,以及它与 DSH 插件在运行机制上的差别。
2026年9月6日
从一次代码语义搜索实验,到一个自动索引、可见状态、后台增量更新的 DeepSeek DSH 插件,我在 dsh-zvec-grep 开发中做了哪些取舍。
2026年9月5日
Magnitude 登上 GitHub Trending:它不只是把开源模型跑在本地,还试图把硬件检测、模型选择、量化和 Agent 接入收进一次安装流程。
2026年8月30日
Cursor 的官方插件仓库再次登上 GitHub Trending。它把 MCP、Skill、规则和 OAuth 连接收进可安装的插件,问题也从“Agent 能不能连服务”变成了“这次授权究竟允许它做什么”。
2026年8月28日
GitHub Trending 上的 Archify 不把架构图当作一张漂亮图片:Agent 先写类型化 JSON,再由本地渲染器验证、交付成单文件 HTML。
2026年8月27日
GLM-5.3-Flash 的官方 Agent benchmark 很强,社区评价却并不一致。完整 DeepSWE、LiveCodeBench、前端生成和并行 Agent 记录,指向了不同的能力边界。
2026年8月24日
Anthropic 的 claude-plugins-community 在 GitHub Today 获得 +257 stars。它不是开放提交的插件仓库,而是把审核、固定提交和夜间同步放在中间的社区分发目录。
2026年8月22日
mattpocock/skills 登上 GitHub Trending:它不是再给 Agent 堆一套提示词,而是把访谈、规格、任务图、TDD 和双轴审查拆成可组合的 Skill。
2026年8月10日
Google 前工程负责人 Addy Osmani 的 Agent Skills 在 GitHub Trending 当天新增 670 stars。它不是一组提示词合集,而是把需求、计划、实现、验证和评审拆成可验证的工程工作流。
2026年8月9日
book-to-skill 登上 GitHub Trending 周榜:它把书籍、文档目录或一组资料整理成按需加载的 Agent Skill,让重复查阅变成一次转换、长期调用。
2026年8月8日
Prime Intellect 新开源的 Prime Agent 登上 GitHub Trending:它用持久化 IPython、递归子 agent 和可回滚的 continual harness,尝试解决 coding agent 跑不久、记不住、改不动自己的问题。
2026年7月28日
HyperFrames 官方 Skill 把画面和渲染都办好了,可一个人做内容,交付的从来不只是一个 mp4。我把封面、文案、博客、推文,还有自己录音这条路,编排成了一个架在官方之上的 Skill,也在这里分享给同样一个人做内容的你。
2026年7月26日
Anthropic 的 Claude Code 团队复盘了 Claude 5 时代的上下文工程新规则:他们把系统提示词删掉 80% 以上,编码评测却没有可测的下降。这篇读完来分享六组“过去 → 现在”的变化,以及我照着新规则改自己开源 Skills 的两处实践。
2026年7月21日
上期用 grill-me 把“改造首页”拷问清楚了,可这份共识只存在于那段对话里 - 换个会话、第二天再开一个 agent,它就一无所知。Matt Pocock 的 to-spec 把已经聊清楚的东西合成成一份 spec,发到你的任务系统,agent 照着建。这篇聊聊它做什么、原理,以及接着改造首页真跑一遍。
2026年7月19日
我们让 AI 写东西,常常是它还没搞明白你要什么就动手,结果返工。Matt Pocock 那个 17 万星 skills 仓库里最受欢迎的 grill-me 把这件事掉了个头 - 让 AI 在动手之前,先一个问题一个问题地把你拷问一遍。这篇聊聊它是什么、原理、怎么装,再拿我自己两次真实使用走一遍。
2026年7月6日
Simon Willison 用 Claude Fable 写完了 sqlite-utils 4.0rc2 - 一个新增 1321 行、删除 190 行、覆盖 30 个文件的 pull request,总花费 149.25 美元。另外还有 MCP 应用层的新思考,以及智能体持续学习的前沿讨论。
2026年6月5日
Greg Isenberg 用六个 prompt 搭了一个会自己更新的 Startup Ideas 看板,然后说了句 build once, let the agent run it。Codex Sites 和 Replit、Lovable 的不同不在功能,而在谁在你不在时继续运营这个应用。
2026年6月2日
让任何 Coding Agent 一行命令就能调 YourWebs API 发布 HTML 页面,我用 writing-skills 让 CC 做了个 yourwebs-skill。想分享的是过程:写 Skill 就是 TDD,关键的 test runner 是上下文为零的 subagent。
2026年5月25日
一月底 Karpathy 在 X 上一条随手推三天内被高频转发,社区配套写的一份 CLAUDE.md 三个月攒下 149K stars、28 天霸占 GitHub trending 第一。把他给 LLM 总结的 3 个老毛病和仓库的 4 条规则对着拆,看怎么贴进项目根目录、怎么判断它真的生效。
2026年5月23日
Martin Fowler 在 5 月 21 号同一天发了两篇 bliki - Vibe Coding 和 Agentic Programming。在一个已经被用烂的词上,他做了一次词义手术。两者的分界线其实只有一条:你到底看不看 LLM 生成的代码 - 而这条线,决定了你能不能把代码“忘掉”。
2026年4月16日
Anthropic 今天发布 Opus 4.7。价格没变、上下文没变,但 SWE-bench Pro 涨了差不多 11 个百分点,第一次支持高分辨率看图,指令遵循也更严格。对开发者来说,这是一次值得立刻换的免费升级。
2026年3月29日
Cursor 很好,但不是唯一选择。这 7 个 AI 编程工具各有特色,有的更开放,有的更便宜,有的在特定场景下体验更好。
2026年2月27日
AI Coding 正在重塑程序员的竞争格局。大龄程序员、年轻人、中间层各自面临什么?不下结论,聊聊不同的可能性。
2026年2月24日
Boris Tane 分享了他使用 Claude Code 的核心原则:永远不要让 Claude 在你审批计划之前就开始写代码。这套研究-规划-标注-实现的工作流,值得每个用 AI 编程的人借鉴。
2025年3月24日
DeepSeek 悄然发布 v3 0324 更新,模型参数规模达 685B,在编程和前端设计方面表现亮眼。本文通过 80 年代风格计时器组件、开源项目网页等实测例子,展示它在代码生成与前端设计上的能力。