2026年5月23日
【AI早读 0523】Gartner 钦点 Codex 与 GitHub Copilot 为 Leader,Dharma 3B 模型成本五十分之一反超 GPT-4o
Gartner 首份企业级 AI 编程智能体魔力象限,把 OpenAI Codex 与 GitHub Copilot 双双列为 Leader;Dharma 用 3B 的 DharmaOCR 以约 1/50 推理成本反超 GPT-4o 等前沿 API;Tunguz 提出可塑界面概念。
博客
记录 AI 系统、产品思考与创作者工作流的实践。
2026年5月23日
Gartner 首份企业级 AI 编程智能体魔力象限,把 OpenAI Codex 与 GitHub Copilot 双双列为 Leader;Dharma 用 3B 的 DharmaOCR 以约 1/50 推理成本反超 GPT-4o 等前沿 API;Tunguz 提出可塑界面概念。
2026年5月23日
Martin Fowler 在 5 月 21 号同一天发了两篇 bliki - Vibe Coding 和 Agentic Programming。在一个已经被用烂的词上,他做了一次词义手术。两者的分界线其实只有一条:你到底看不看 LLM 生成的代码 - 而这条线,决定了你能不能把代码“忘掉”。
2026年5月22日
OpenAI 推理模型用不到 $1000 的算力推翻一个悬置 80 年的 Erdős 猜想;AWS 同一天密集发布 6+ 篇 Bedrock AgentCore 技术博客,SageMaker 推出 OpenAI 兼容 API - 推理能力进化与智能体基建定型并行。
2026年5月20日
两个大事件撞在同一天 - Andrej Karpathy 加入 Anthropic 主攻预训练,Google I/O 2026 发布 Gemini 3.5 Flash;外加 Claude Managed Agents 上线 Cloudflare、AWS 推出 Programmatic Tool Calling。
2026年5月19日
今天聚焦 Agent 从评估到部署 - IBM 跨场景排行榜、OpenAI×Dell 把 Codex 推进企业本地环境、Anthropic 谈长时任务稳定性,以及一份系统的 Agent 评估指南。
2026年5月16日
今天聚焦 LLM 架构、预训练稳定性和 AI 学习边界:Sebastian Raschka 梳理长上下文效率相关的新架构,Dwarkesh Patel 总结打破因果性与引入偏置如何导致训练失败,同时讨论强化学习与人类学习之间不能被忽视的差异。
2026年5月15日
a16z 这周发了一篇观点文章 - From System of Record to System of Intelligence。同一天 Notion 把工作区改造成 AI agent hub。两件事放一起看,是 SaaS 产品形态的一次方向调整 - 入口正在从“我帮你把数据存好”挪到“我帮你拉所有上下文做事”。
2026年5月14日
把我自己玩 Fantasy Premier League 的工作流写成了一个 skill,叫 fpl-copilot - 数据存本地 SQLite,阵容用 Markdown 持久化,每个 GW 的分析输出成自包含的 HTML 报告。Claude Code 和 Codex 都能装,聊聊几个设计选择。