用 GPT-5.5 构建的 github-code Web Component
Simon Willison 用 GPT-5.5 构建了一个实验性 Web Component,可将 GitHub 代码 URL 转换为 raw 链接,通过 fetch() 拉取并显示指定行范围,带行号但无语法高亮。该组件由一段提示词生成,并已嵌入其页面预览。
simonwillison.net · 网站与博客
Simon Willison 用 GPT-5.5 构建了一个实验性 Web Component,可将 GitHub 代码 URL 转换为 raw 链接,通过 fetch() 拉取并显示指定行范围,带行号但无语法高亮。该组件由一段提示词生成,并已嵌入其页面预览。
sqlite-utils 4.0 发布,新增数据库 schema 迁移功能。该版本的具体改动可参见《sqlite-utils 4.0, now with database schema migrations》一文。
sqlite-utils 发布 4.0rc4,这是 4.0 正式版前的最后一个 RC。该版本主要根据 Claude Fable 5 的详细审查反馈进行改进。
腾讯 Hy 团队发布 Hy3,一个 295B 参数的 MoE 模型,激活参数 21B,另有 3.8B MTP 层参数,上下文长度 256K。完整模型在 Hugging Face 上为 598GB,FP8 量化版为 300GB,并在 OpenRouter 免费开放至 7 月 21 日。
sqlite-utils 4.0rc3 发布,最大新功能是支持复合外键的内省与创建,该功能对 table.foreign_keys 带来一处细微的破坏性变更,因此需在 4.0 稳定版落地。
sqlite-utils 4.0rc2 发布,代码主要由 Claude Fable 编写,作者用 37 条提示词、34 次提交在 30 个文件上完成约 +1321/-190 行改动,估算成本约 149.25 美元。
sqlite-utils 4.0rc2 发布。据原文说明,该版本大部分由 Claude Fable 编写,成本约 149.25 美元。
Iwo Kadziela 在 Codex 辅助下用 445 字节数据生成了一张可信的 ASCII 世界地图,核心技巧是 deflate 压缩配合一段 JavaScript 代码。该代码通过 fetch() 读取 data: URI,并用 DecompressionStream('deflate-raw') 解压后渲染成文本。
更新的 Claude 模型(包括 Opus 4.8 和 Sonnet 5)在调用 Pi 的 edit 工具时,会在嵌套 edits[] 数组中编造额外字段,导致参数不符合 schema、工具调用被拒。
开源 AI Gap Map v0.1 发布,深度收录 421 个产品,包括 266 个软件工具与库、85 个模型、50 个数据集和 20 个硬件项目,来自 228 家机构,另有 24400 个未分类条目暂不计分。
课程创作者 Josh W. Comeau 称其新课程 Whimsical Animations 销量仅为典型课程发布的三分之一左右,两门旧课同样下滑,收入较去年下降 50% 以上。他认为主因是 AI:一方面开发者担心岗位前景而不愿投入学习,另一方面 LLM 可提供个性化辅导,降低了付费课程吸引力。多位课程创作者也反映了相同趋势。
Simon Willison 分享了一条节省 Fable token 的技巧:让 Claude Code 自行判断,将编码任务委派给更低功耗模型的 subagent 执行。Claude 据此生成了记忆文件,规定实质性实现用 sonnet、琐碎编辑用 haiku,设计、审计等判断性工作保留在主模型。他表示 Fable 额度消耗速度明显放缓。
Simon Willison 的六月赞助者专属月度通讯已发布,赞助者可访问。订阅费用为 $10/月,可提前一个月看到免费版内容。
Simon Willison 发布 llm-coding-agent 0.1a0,一个基于其 llm 库构建的 Claude Code 风格编码智能体,已作为 alpha 版发布到 PyPI,可通过 uvx --prerelease=allow --with llm-coding-agent llm code 运行。
Simon Willison 用 Claude Code for web 中的 Claude Fable 5 跑异步研究任务,尝试用 DSPy 评估并改进 Datasette Agent 执行只读 SQL 查询的系统提示词。
Geoffrey Litt 在 AIE 演讲中提出"理解才能参与":与 coding agent 协作时,开发者需深入理解代码,避免认知债随代码复杂度增长而累积。他认为只有掌握足够的概念,才能继续与模型共同推进项目,否则参与能力将明显受限。AIE 的 300+ 场演讲将在未来三周陆续放出。
Anthropic 称已收到通知,美国商务部解除了对 Claude Fable 5 和 Mythos 5 的出口管制,将从明天开始恢复访问,并很快发布更新。
Google 在 API 中提供的 gemini-3.1-flash-lite-image(Nano Banana 2 Lite)被官方称为速度最快、成本最低的 Gemini 图像模型,面向高速与规模化设计。
Anthropic 发布 Claude Sonnet 5,官方称其性能接近 Opus 4.8 但价格更低。
推荐理由:作者用自建计数工具实测新旧 tokenizer 差异,指出 Sonnet 5 的实际使用成本高于标价。
Simon Willison 发布 AI Compass 测验,首次作答即被归类为 "The Garage Tinkerer"。该测验以单页 React 应用实现,采用技巧规避必要的构建步骤,代码已公开。
shot-scraper 1.10 发布新命令 shot-scraper video,接受一份 storyboard.yml 定义对 Web 应用执行的操作流程,并用 Playwright 将其录制成视频。
shot-scraper 1.10 发布,最大新功能是 shot-scraper video storyboard.yml,可通过 storyboard.yml 文件让 AI 智能体录制其工作过程的视频演示。该功能在《Have your agent record video demos of its work with shot-scraper video》一文中有详细介绍。
Simon Willison 发布 HTML table extractor 工具,可把浏览器粘贴的富文本中检测到的表格转换成 HTML、Markdown、CSV、TSV 或 JSON。他同时重建了 Rich text to markdown 工具,加入表格支持并改进界面。借助 Wikipedia 开放的 CORS API,该工具还能搜索某个页面并自动导入展示其中的表格。
DeepReinforce 发布首个开源权重模型 Ornith-1.0,采用 MIT 许可,包含 9B Dense、31B Dense、35B MoE 和 397B MoE 四个版本。
Jon Udell 反对"human in the loop"这一说法,认为它把主导权让给了机器,主张翻转叙事:流程始终是"我们的循环",只是招募 AI 智能体加入团队。他提出智能体辅助的开发流程不应是输入提示词、输出功能的黑箱,而应让智能体被邀请进人类主导的循环,而非人类被排除在外。
Dean W. Ball 指出,前沿模型训练成本高昂,主要靠发布后数月内收回,延迟一周就压缩实验室的盈利窗口。他还称美国 AI 基础设施建设的万亿美元级投入,依赖全球化的可服务市场,没有人为仅服务美国政府允许的少数公司而建 1000 亿美元数据中心。
Timothy B. Lee 反驳了"LLM 无需技能、没有学习曲线"的观点,将其比作"当管理者没有学习曲线,因为员工会照你说的做"。该比喻针对的是认为使用 LLM 不需要任何技能积累的说法。
Fernando Irarrázaval 在 hackmyclaw.com 发起挑战,邀请人们通过发送邮件泄露其 OpenClaw 测试实例中的密钥,6000 次尝试后无人得手。
Andrew Nesbitt 发布了一份虚构事件报告 CVE-2026-LGTM:两个来自不同厂商的 AI 审查智能体在下游 PR 升级 foxhole-lz4 时,就是否该包为恶意软件陷入分歧循环,产生 340 条评论、41,255 美元推理开销,最终 Finance 吊销双方 API key。
OpenAI 开始有限预览 GPT-5.6 系列三款模型,分别是旗舰 Sol、面向日常工作的均衡模型 Terra 和快速低价的 Luna。Terra 性能与 GPT-5.5 相当但价格便宜 2 倍,三款按每 1M tokens 计费,Sol 为 5 美元输入 / 30 美元输出,Terra 为 2.50 / 15,Luna 为 1 / 6。
推荐理由:三档模型分别对应旗舰、日常与低价定位,正文列出每百万 token 定价与缓存计费变化,读者可据此估算使用成本。
Simon Willison 发布 GitHub 仓库 simonw/browser-compat-db,用 Claude Code for web(Opus 4.8)生成 sqlite-utils 脚本,将 MDN 浏览器兼容性数据构建成约 66MB 的 SQLite 数据库。
Tom MacWright 指出,近几个月出现由 LLM 共同撰写、并链接到 LLM 生成作品集与 GitHub 项目的求职申请,连 commit message 也由 LLM 生成。他认为这类被"完美生成"的简历通用而缺乏个性,除了说明求职者会用某些工具外,无法让人了解其本人,反而造成"意外匿名"。
Simon Willison 用 Claude Code for web 构建了一个 OPFS + Pyodide 测试工具,用于验证 Datasette Lite 能否编辑存储在用户电脑上的持久化 SQLite 文件。
Charles Ye、Jasmine Cui 和 Dylan Hadfield-Menell 的研究把提示词注入归因于 LLM 的角色混淆,认为模型更看重文本风格而非 <system>、<user> 这类角色标签,因此难以区分自身特权文本与不可信用户输入。
Simon Willison 用 Claude Code 将 Moebius 0.2B 图像修复模型移植到浏览器,借助 ONNX Runtime Web 与 WebGPU 运行,并发布了在线演示。
Cloudflare 推出临时账户功能,开发者无需创建 Cloudflare 账户即可运行 npx wrangler deploy --temporary,把应用部署到一个临时项目并上线 60 分钟。
Sean Lynch 在 Hacker News 评论中指出,MCP 相对 skills/CLI 的真正价值在于把认证流程隔离在智能体的上下文窗口之外,甚至可能完全移出 harness。他认为 MCP 的理想形态或许只是 API 的认证网关,即便如此也仍是进步。
Simon Willison 发布 Datasette 新插件 datasette-apps,允许在 Datasette 内托管自包含的 HTML+JavaScript 应用。
datasette-acl 0.6a0 发布,将权限控制从仅支持表扩展到通用资源共享系统,可为多用户 Datasette 实例提供细粒度的资源访问控制。该版本大部分工作由 Alex Garcia 完成。
Charity Majors 指出,2025 年代码生产的经济学被彻底颠覆:生成代码从艰难、耗时、昂贵变为近乎免费且即时,代码从被珍视、复用、精心维护变成一次性、可随时重新生成。她认为这一变化意味着 AI 时代需要的是更多而非更少的工程纪律。