2026年6月19日
【AI早读0619】GLM-5.2登顶开源,智能体安全框架密集发布
GLM-5.2 以 753B MoE、百万 token 上下文和 IndexShare 稀疏注意力机制登顶开放权重模型;Google DeepMind 发布 AI Control 路线图,Amazon Bedrock AgentCore 正式 GA,智能体安全与运行基础设施同步加速。
博客
记录 AI 系统、产品思考与创作者工作流的实践。
2026年6月19日
GLM-5.2 以 753B MoE、百万 token 上下文和 IndexShare 稀疏注意力机制登顶开放权重模型;Google DeepMind 发布 AI Control 路线图,Amazon Bedrock AgentCore 正式 GA,智能体安全与运行基础设施同步加速。
2026年6月17日
OpenAI 发布 Deployment Simulation,用真实对话分布模拟新模型上线后的行为、发布前预测安全风险;Martin Fowler 网站用 Bayer 的 PRINCE 案例,聊 Context Discipline 与 Harness Engineering 如何提升 Agentic RAG。
2026年6月16日
三篇 AWS 博客串成一条线:Strands Evals SDK 用 Detector 自动分析 Agent 执行轨迹,给出故障分类与修复建议;LangChain Deep Agents 加 Bedrock AgentCore 建研究代理;Gemma 4 系列登陆 Amazon Bedrock。
2026年6月15日
Google DeepMind 解释为什么简单过滤 SFT 数据难以消除安全相关行为,关键可能在教师模型回答的行为迁移;Pyodide 开始支持把 WASM wheels 直接发布到 PyPI;GPU 时间分片则为 Kubernetes 上并发运行多个 LLM Agent 提供工程路径。
2026年6月14日
美国政府援引国家安全权力,要求 Anthropic 暂停外国国民访问 Fable 5 与 Mythos 5;与此同时,Microsoft SkillOpt 展示如何像训练模型权重一样迭代优化 Markdown skill,GLM-5.2 等新进展也在继续推动模型能力边界。
2026年6月13日
Simon Willison 记录 Claude Fable 5 的 relentlessly proactive:为查一个滚动条 bug 自主注入代码、自写诊断服务、跨浏览器截图验证;Google DeepMind 提出模型 diffing,让审计智能体主动搜两个模型的行为差异。
2026年6月12日
OpenAI 收购 Ona,给 Codex 补上持久化云执行 - 电脑离线后 Agent 仍能在企业自有云里接着跑;Google Cloud 用 TEE 推出 Confidential AI;Anthropic 发企业订阅 Claude Corps;AWS 开源 Agent-EvalKit 评估 Agent。
2026年6月11日
Google 昨天连发三项:把文本生成提速 4 倍的 DiffusionGemma、一行 SDK 拉起 4 vCPU 沙箱的 Gemini Managed Agents,以及给机器遗忘做置信度评估的审计框架。再加 GitHub Copilot CLI 接入 LSP 与 Fable 5 静默拒绝观察。