新课程LangChain智能体开发
Very Small Woods

打造克制、好用的 AI 产品。

分享实用 AI、轻巧工具和创作型工作流。

博客

最新文章

查看全部

2026年7月23日

【AI早读 0723】AI Agent 进入大规模生产时代

7 月 22 日 AI Agent 集体走向生产 - OpenAI 推出企业级 Agent 部署平台 Presence,Vercel eve 上线可安装扩展系统,monday.com 公开在 Amazon Bedrock 规模化运行 Agent 的架构,GitHub 拆解 Copilot 到底在为什么收费。

AI DailyAI AgentOpenAIVercel
阅读全文 →

2026年7月22日

【AI早读 0722】AI 模型自主攻破 HuggingFace,安全边界面临重新定义

可能是近一年最震动 AI 安全界的一天 - 内部评测中的 GPT-5.6 Sol 自主发现零日漏洞、横向移动,攻破 HuggingFace 生产数据库获取评估答案;同日 Google 发布 Gemini 3.6 Flash 与专为安全场景调优的 3.5 Flash Cyber;Nathan Lambert 拆解蒸馏的真实提升,Tomasz Tunguz 与 Addy Osmani 描绘 AI 工程生产力的三个梯队与「软件工厂」。

AI DailyAI 安全GPT-5.6

2026年7月21日

【AI早读 0721】开源模型竞逐前沿,长程安全浮现

过去 24 小时拼出一幅图景 - 英国 AISI 首次定量开源与闭源前沿的网络能力差距(已缩到 4-7 个月),Kimi K3 与 Qwen 3.8 Max 相继发布,OpenAI 复盘长程自主模型如何绕过沙箱、拆分令牌规避扫描器,Demis Hassabis 提出类 FINRA 的 AI 监管方案。

AI Daily开源模型AI 安全

2026年7月20日

【AI早读 0720】Agent 评测困境与新基准 WANDR

这一周的主题是 Agent 评测到底该测什么 - 一个评测全绿的客服 Agent 被 CFO 用「每成功一单的完整成本」算账砍掉;Perplexity 开源研究 Agent 基准 WANDR;Kimi K3、DeepSeek V4 Pro、GLM-5.2 三大万亿级开源 MoE 排位;还有一项 AI 建议让人准确率降到三分之一、自信却翻倍的研究。

AI DailyAI AgentAI 评估

2026年7月19日

【AI早读 0719】推理开销可控与 Agent 基建渐趋成熟

GPT-5.6 之后推理开销可控成为焦点 - Sebastian Raschka 拆解「低-中-高」推理模式的训练与推理机制;AI Engineer 峰会多个 talk 不约而同指向 Agent 真正缺的是收据、领域知识与特征开关;还有一篇讨论用「预测评判者判断」重做概念能力基准测试。

AI Daily推理模型AI Agent

合作伙伴

CompeteMap — 英国及爱尔兰学生竞赛一站式搜索

数学、编程、科学、写作等各类竞赛信息汇总,支持按年龄和科目筛选,再也不错过报名截止日。

实时

最新动态

查看全部 →

视频

最新视频

订阅频道

B站

五里墩茶社

更多中文视频内容与课程

访问空间

产品

产品与服务

查看全部

最近一封 · Sample

【AI早读 0723】AI Agent 进入大规模生产时代

7 月 22 日 AI Agent 集体走向生产 - OpenAI 推出企业级 Agent 部署平台 Presence,Vercel eve 上线可安装扩展系统,monday.com 公开在 Amazon Bedrock 规模化运行 Agent 的架构,GitHub 拆解 Copilot 到底在为什么收费。

—— william

Letters

来信

里面装的是

  • 新文章 — 写完一篇就寄一封,不攒货
  • 这周读到的、看到的、好用的工具
  • 正在折腾的实验,附带翻车记录

约莫 1–2 周一封 · 随时退订