2026年9月19日
Jev 实测:这款爆火的极速决策模型的基本玩法
TypeSafe AI 的 Jev 发布当天在 Hacker News 拿到 1679 分。我搭了一个 Playground 跑了五个场景,把官方宣称、独立实测和自己测出来的数字分开放,说说它适合什么、不适合什么。
2026年9月19日
TypeSafe AI 的 Jev 发布当天在 Hacker News 拿到 1679 分。我搭了一个 Playground 跑了五个场景,把官方宣称、独立实测和自己测出来的数字分开放,说说它适合什么、不适合什么。
2026年9月13日
Codex 的 apply_patch 不只是把几行文本写回文件。本文从 Patch、diff 和 hunk 讲起,逐层拆解它的语法、解析、上下文匹配、预验证、权限评估、文件系统执行与部分失败边界。
2026年9月6日
从 settingsNamespace 导出变化导致启动失败,到旧 workspace 配置在消息处理阶段暴露问题,这是一次发生在 DSH RC 版本升级中的兼容性调试记录。
2026年9月6日
从一次代码语义搜索实验,到一个自动索引、可见状态、后台增量更新的 DeepSeek DSH 插件,我在 dsh-zvec-grep 开发中做了哪些取舍。
2026年8月30日
Cursor 的官方插件仓库再次登上 GitHub Trending。它把 MCP、Skill、规则和 OAuth 连接收进可安装的插件,问题也从“Agent 能不能连服务”变成了“这次授权究竟允许它做什么”。
2026年8月28日
GitHub Trending 上的 Archify 不把架构图当作一张漂亮图片:Agent 先写类型化 JSON,再由本地渲染器验证、交付成单文件 HTML。
2026年8月27日
GLM-5.3-Flash 的官方 Agent benchmark 很强,社区评价却并不一致。完整 DeepSWE、LiveCodeBench、前端生成和并行 Agent 记录,指向了不同的能力边界。
2026年8月27日
Scientific Agent Skills 登上 GitHub Trending 的背后,是 163 个科研流程与一款本地 AI co-scientist 的组合。它把 Agent 从“回答问题”推进到可检查的研究过程。
主题簇
最近一封 · Sample
“TypeSafe AI 的 Jev 发布当天在 Hacker News 拿到 1679 分。我搭了一个 Playground 跑了五个场景,把官方宣称、独立实测和自己测出来的数字分开放,说说它适合什么、不适合什么。”
—— william
里面装的是
约莫 1–2 周一封 · 随时退订