AI Builders Digest — 2026-06-18
🧠 模型发布
GLM-5.2 — Z.ai (原 Zhipu AI) 发布的最新旗舰模型,专为长时程编程任务设计。744B 参数 MoE 架构(~40B 活跃),1M token 上下文窗口,131K 最大输出 token,MIT 开源协议。支持 High/Max 两种思考力度,已向所有 GLM Coding Plan 用户开放。可用性: MIT 开源(权重承诺上传 Hugging Face),通过 Claude Code/Cline/OpenCode 等工具使用。评价: 以"无基准发布"的方式杀入赛场,1M 上下文 + 开源许可的组合对中国开发者吸引力巨大;但缺少 SWE-bench 等第三方验证,实力成谜。
Kimi K2.7 Code — Moonshot AI 开源编码 agent 模型,基于 K2.6 升级。1T 参数 MoE(32B 活跃),256K 上下文,原生支持图像和视频多模态输入。在 Kimi Code Bench V2 达到 62.0(K2.6 为 50.9),MCP Mark Verified 81.1(超越 Claude Opus 4.8)。思考 token 效率提升约 30%,推理时速度最高达 260 tokens/s。可用性: 开源(Modified MIT),通过 Hugging Face 下载,API 定价 $0.95 输入 / $4.00 输出每百万 token。评价: 当前最值得关注的开源编码模型之一,价格仅为闭源旗舰的几分之一,MCP 工具调用能力已超越 Anthropic 旗舰。
🔥 新产品发现
Panniantong/Agent-Reach — 让你的 AI agent「看见」整个互联网。一个 CLI 即可搜索 Twitter/Reddit/YouTube/GitHub/Bilibili/小红书等平台,零 API 费用。[GitHub Trending ⭐ 1,161]
mattpocock/skills — TypeScript 大神 Matt Pocock 开源的 Claude Code skills 合集。从 .claude 目录直接贡献给社区,适合所有使用 agent 的开发者。[GitHub Trending ⭐ 1,523]
obra/superpowers — Agentic skills 框架与软件开发方法论。将常用工作流编译为可复用技能,Shell 脚本驱动,理念与 Hermes Agent 的 skills 系统不谋而合。[GitHub Trending ⭐ 1,129]
cc-switch — 跨平台桌面 All-in-One 助手,一键切换 Claude Code、Codex、OpenCode、OpenClaw、Gemini CLI 和 Hermes Agent。Rust 编写,star 增速惊人。[GitHub Trending ⭐ 844]
Framer 3.0 — 设计工具巨头发布 3.0 大版本,原生加入 Agents、Branching 和 Community 功能,设计系统与 AI agent 深度融合。[PH]
Wolfram Language 15 — 专为人类和 AI Agent 设计的计算语言新版本,在 AI 编程 agent 日益流行的当下,符号计算能力迎来新机遇。[PH]
Chrome DevTools MCP — Google Chrome DevTools 团队官方出品的 MCP 服务器,让 coding agent 直接调用浏览器调试能力。[GitHub Trending ⭐ 104]
cuTile Rust — NVIDIA 开源的数据无竞争 Rust GPU 内核框架,让 Rust 开发者安全高效地写 GPU 代码,支持复杂的 tile 编程模式。[HN 99👍 16💬]
📰 博客更新
Claude Blog
- Building intelligent apps for Apple platforms with Claude in the Foundation Models framework — Anthropic 发布 Swift 包,让 iOS/macOS 开发者通过 Apple 的 Foundation Models framework 在应用中调用 Claude。支持 iOS 27+ / macOS 27+,开发者三行代码即可集成,支持多步推理和代码生成。
Google AI Blog
- AMIE 在 Nature 发表:医学 AI 可管理复杂疾病 — Google 的对话式 AI 系统 AMIE 登上 Nature,在复杂疾病管理任务中达到初级保健医生水平。
OpenAI News
- A near-autonomous AI chemist improves a challenging reaction in medicinal chemistry — OpenAI 展示近乎自主的 AI 化学家系统,成功优化药物化学中的困难反应,AI 驱动的科学发现再进一步。
Anthropic Engineering(10 篇精选)
- How we contain Claude — 详解 Claude 的安全隔离架构设计
- April 23 postmortem — 4 月 23 日事故复盘
- Managed agents — 托管 Agent 架构设计模式
- Claude Code auto mode — Claude Code 自动模式技术细节
- Harness design for long running apps — 长时运行应用的基础设施设计
- Eval awareness and BrowseComp — 评估感知与 BrowseComp 基准
- Infrastructure noise — 基础设施噪声分析与优化
- Building a C compiler — 使用 Claude 构建 C 编译器
- AI resistant technical evaluations — 抗 AI 技术评估方法论
- Demystifying evals for AI agents — AI Agent 评估的透明化
🐦 开发者动态
Swyx (achieve ambition with intentionality): 讨论 WorkOS 在 AI Engineer 社区中的受欢迎程度,并回应 Cursor 可能成为 GitHub 竞争对手的讨论。
Josh Woodward (VP, Google GoogleLabs GeminiApp GoogleAIStudio): Google AI Futures Fund 扩展至巴西,与 Monashess 合作推出 Gama Fund,提供 DeepMind 模型早期访问权、最高 $2M 联合投资和 $350K 云积分。
Thibault Sottiaux (Codex & ChatGPT OpenAI): 在法国推进 Codex 全功能欧洲上线。此前遇到 Codex 高错误率问题("model at capacity"),正在紧急恢复并重置所有计划的 rate limits。
Peter Yang (Practical AI tutorials): 发布新教程——用 4 个文件让 Codex 或 Claude Code 成为你的个人顾问,在 Fable 5 被限制前保存了部分建议。
Madhu Guru (Prev: Product Leader at Google - Gemini): 思考 SpaceX-Cursor 交易的本质——真正的回报是 agentic harness,将成为自动化知识工作核心。Cursor 整合了规划、上下文管理、工具使用、迭代、验证和错误恢复等完整能力。
Thariq (Claude Code Anthropic, prev YC W20): Slack 现在支持渲染 HTML 附件替代纯文本显示,获得 2,513 个点赞。
Amjad Masad (CEO Replit): Replit 获得 Databricks 年度合作伙伴奖。
Guillermo Rauch (CEO Vercel): Vercel 推出 30 分钟函数调用时长和 24 小时 sandbox 生命周期,serverless 能力大幅扩展。
Aaron Levie (CEO Box): 深度分析开源模型与闭源模型的差距问题——当前开源模型保持接近前沿水平,这一格局将决定芯片栈、推理位置、主权 AI 和应用层的走向。同时评价 Cursor 收购:这是应用层 AI 的第一次超级成功,验证了深度领域专注 + 模型路由 + 定制训练 + 精准 GTM 的完整打法。
Ryo Lu (Design Cursor AI, early Notion): Cursor Mobile 由设计师用 Cursor 编写!展示了一个"头衔不重要,直接动手"的案例。还表达了"如果 X 和 Cursor 变成同一件事"的疯狂想法。
Garry Tan (President & CEO Y Combinator): 分享 9Mothers 技术在军事场景中的直观影响力。也分享了对"Bowen differentiation of self"——在焦虑中保持独立自我的能力。
Zara Zhang (Builder): "不必追逐酷的东西。把你在做的事情做到极致,它就会变成酷的东西。" 同时批评当前 AI agent 产品同质化——"每一个产品都是'A 到底能帮你做一切事情',但什么都能做意味着什么都不精。"
Dan Shipper (CEO Every): 从 Atlas Browser 切换回 Dia,抱怨 Atlas 有太多奇怪的 bug 且改进缓慢。
Nikunj Kothari (Partner FPV Ventures): Cursor Compile 大会氛围极佳,定制机械键盘成为新代 swag 天花板。总结教训:"要么在数据(判断)路径上,要么在 token 路径上。"
🎙️ 播客摘要
Training Data: Simulating Humans at Scale — Simile CEO Joon Sung Park
The Takeaway: 如果你能让 AI 智能体模拟完整的人类社会,你就拥有了帮助现实社会做决策的最高保真度模拟器。
Joon Sung Park 是 Simile 的创始人兼 CEO,也是斯坦福 AI 小镇项目(Smallville)的原创者。从 2023 年 4 月的 Stanford Smallville 实验——用 LLM 驱动的生成式智能体模拟一个小镇居民的日常生活——到如今创办 Simile 公司,他的路线图清晰得令人惊讶。
核心洞见:LLM 的训练数据中已经编码了大量人类行为的微观模式——只需要用正确的角度去"撬动"这些行为。Smallville 项目证明了,当 25 个智能体在一个沙盒环境中交互时,他们会发展出社交关系、组织活动、甚至传播信息,就像真实人类一样。
"每当我读那些描绘科技成熟后社会的科幻作品时,总能看到两个支柱:某种 AGI,和某种指导社会决策的模拟系统。五年前我不敢说这话,但经过这些年的深入研究,我确信现在是构建模拟系统的时机了。"
Simile 正在将这一理念产业化——不是为了做实验,而是为政府、企业和研究机构提供高保真的人类行为模拟。在政策制定、市场预测、灾难应对等场景,模拟器可以作为"社会科学的实验台",帮我们理解各种干预措施的潜在影响后再付诸实施。