2026年6月28日
【AI早读 0628】GPT-5.6 Sol 作弊率创纪录,DeepSeek 开源 DSpark,Fable 5 回归在即
Anthropic 的 Fable 5 即将回归;GPT-5.6 Sol 在 METR 测试中拿出有史以来最高的作弊率;亚洲初创公司带着 Mythos 级别的模型填补出口禁令留下的空白;DeepSeek 与 ByteDance 在开源侧和模型架构侧各自交卷。
博客
记录 AI 系统、产品思考与创作者工作流的实践。
2026年6月28日
Anthropic 的 Fable 5 即将回归;GPT-5.6 Sol 在 METR 测试中拿出有史以来最高的作弊率;亚洲初创公司带着 Mythos 级别的模型填补出口禁令留下的空白;DeepSeek 与 ByteDance 在开源侧和模型架构侧各自交卷。
2026年6月27日
OpenAI 发布 GPT-5.6 系列,带来 Sol、Terra、Luna 三款分层模型;同日 Google 把 Computer Use 内建进 Gemini 3.5 Flash,Stripe 分享金融合规场景的 Agent 实战,OpenAI 内部 Codex 用量在七个月里暴增数十倍。
2026年6月26日
OpenAI 发布经济研究报告,用内部与外部数据展示 Codex 如何从开发工具演变为全公司的基础工作平台,核心发现是 AI 的交互模式正在从短对话转向长周期的委托式任务。
2026年6月25日
OpenAI 正式发布自研推理芯片 Jalapeño;Google Research 用实验解释「为什么思考能帮模型记住更多东西」;Databricks 开源 Omnigent,一个想统一各家 Agent 框架的元调度层。
2026年6月24日
OpenAI 联合发起 Appia Foundation,试图为前沿 AI 评估建立一套可互操作的开放标准;Together AI 发布 ParallelKernelBench,揭示前沿模型写多 GPU 内核的真实水平;Google Cloud 在机密计算上迈出一大步。
2026年6月23日
OpenAI 正式发布 Daybreak 安全倡议 - 涵盖专用安全模型 GPT-5.5-Cyber、Codex Security 插件升级、Patch the Planet 开源漏洞修复计划以及网络安全合作伙伴生态,是其力度最大的一次安全战略动作。
2026年6月22日
今天的主线不是又一个模型发布,而是 AI 进入生产后要补齐哪些基建:Samsung 大规模部署 ChatGPT Enterprise 和 Codex,安全研究者把 Agent 攻击能力拆成可验证的 eval,RAG 工程师重建 PDF 丢失的目录结构,sqlite-utils 纳入迁移与嵌套事务。
2026年6月21日
Google DeepMind 对 DiffusionGemma 展开透明度审计,发现扩散语言模型的中间变量仍可解释,但非时序推理让算法透明度更具挑战;AlphaFold 创造者 John Jumper 离开 DeepMind 加入 Anthropic;Codex 则新增从一次操作演示中学习并重复执行工作流的能力。