Datasette-agent 0.1a1 发布
Datasette-agent 0.1a1 发布,该版本在决定向用户列出哪些表时改用 execute-sql 权限(#8)。该版本带有 execute-sql 标签,属于 datasette 与 datasette-agent 项目。
simonwillison.net · 网站与博客
Datasette-agent 0.1a1 发布,该版本在决定向用户列出哪些表时改用 execute-sql 权限(#8)。该版本带有 execute-sql 标签,属于 datasette 与 datasette-agent 项目。
Simon Willison 发布 datasette-ip-rate-limit 0.1a0,这是一个可配置的 Datasette 限流插件,用于封禁过快访问站点特定区域的 IP。
Simon Willison 借助 OpenAI Codex 桌面版搭建了 Datasette 博客,并称该工具具备他一直想要的 Markdown 会话记录导出功能。他还公开了搭建该博客的完整会话记录,并关联了 issue 179。
Boris Mann 指出,“11 AI agents”这个说法本身毫无意义,就像说“我有 11 个电子表格”或“我有 11 个浏览器标签页”来工作一样,含义差不多。他认为用数量描述 AI 智能体并不能说明任何实质内容。
Simon Willison 用 Codex 桌面应用中的 GPT-5.5 xhigh 构建了一个 CSP 允许列表实验,可在受 CSP 保护的沙箱 iframe 中加载应用,并通过自定义 fetch() 拦截 CSP 错误上报给父窗口。父窗口随后提示用户将该域名加入允许列表并刷新页面。
Datasette 发布 1.0a29,新增 TokenRestrictions.abbreviated(datasette) 工具方法用于生成 "_r" 字典,并修复了零行表格仍显示表头与列选项、Mobile Safari 上列操作对话框显示异常等问题。
Mo Bitar 在 TikTok 发布《The Unethical Guide to Surviving AI Layoffs》,调侃用“Ralph Loop”这一说法向 CEO 索要 18000 美元 API 额度以换取升职。他建议不断谈论自动化、在 Slack 公开频道点名同事已被“Ralph Looped”,并同时 @CEO,以此避免被裁。
Mitchell Hashimoto 在讨论 Redis 首页设计时指出,90% 的技术决策者(TDM)首要动机是"不被解雇",他们朝九晚五、周末不碰代码,只跟随分析师和大众情绪认可的趋势。Gartner 说"AI 战略"最重要、麦肯锡说"上下文"需要管理,他们就会去买"Context Engine for AI Apps"这类产品。
Simon Willison 发布 LLM 0.32a2 alpha 版,多数支持推理的 OpenAI 模型改用 /v1/responses 端点,取代 /v1/chat/completions。
GitLab 宣布因应智能体时代进行裁员和结构性战略调整,计划将设有小型团队的国家数量最多减少 30%,并在部分职能中削减最多三层管理。它还计划把 R&D 重组为约 60 个更小、拥有端到端所有权的独立团队,并停用 CREDIT 价值观,改用 Speed with Quality、Ownership Mindset、Customer Outcomes。
James Shore 指出,AI 编程智能体必须降低维护成本,且降幅要与它提升编码速度的倍数成反比:编码快 2 倍,维护成本就得减半;快 3 倍,就得降到三分之一。若产出翻倍而维护成本不变,总维护成本仍会翻倍;若产出和维护成本同时翻倍,维护成本将变成原来的四倍。
Jason Koebler 撰文指出,AI 写作正变得难以回避,过滤这些内容令人精神疲惫,甚至开始扭曲正常人的写作风格。他提出"Zombie Internet"概念,区别于"Dead Internet":不只是机器人与机器人对话,而是人对着机器人说话、人指挥 AI 智能体去与人互动、用 AI 的人与不用 AI 的人交谈,以及 AI 网红批量制造自动化 YouTube 频道、博客和社交账号刷屏牟利。
Simon Willison 分享了把 llm 命令写进脚本 shebang 行的写法,让脚本可以直接执行其中的提示词,灵感来自 Hacker News 上的一条评论。
在 Shopify,AI 智能体 River 不接受私信,而是建议创建公开 Slack 频道一起工作,使每段对话都可被搜索、任何人都能加入讨论。Shopify 把这种把工作尽量可见、彼此观摩的做法称为 Lehrwerkstatt(教学工坊),不需要课程表或培训计划。
《纽约时报》发布编辑更正,称该报在得知一篇报道中归于加拿大保守党领袖 Pierre Poilievre 的言论实为 AI 生成的对其观点的总结、并被呈现为直接引语后更新了文章。更正说明记者本应核查 AI 工具返回内容的准确性,文章现已改为准确引用 Poilievre 4 月的一次演讲,并指出他在该演讲中并未将改换阵营的政客称为叛徒。
Luke Curley 指出,WebRTC 为保持低延迟会激进丢弃音频包,导致网络不佳时用户的提示词被直接丢掉,而浏览器内甚至无法重传 WebRTC 音频包,Discord 曾尝试也未果。他认为用户宁愿多等 200ms 换取准确提示词,因为垃圾提示词只会得到垃圾回答。
Simon Willison 撰文反思 Anthropic Claude Code 团队 Thariq Shihipar 提倡用 HTML 取代 Markdown 作为模型输出格式的观点。
llm-gemini 0.31 发布,Gemini 3.1 Flash-Lite 不再是预览版。作者称该正式版模型自 3 月的 Gemini 3.1 Flash-Lite Preview 以来应该没有变化。
Simon Willison 为其 vibe coding 开发的 macOS 演示工具 Big Words 新增了一个页面,可通过 query string 参数把文本转成简单幻灯片,因为该工具只接受 URL 输入。双击或双击触控板可打开表单修改各项选项。
Mozilla 借助 Claude Mythos 预览版定位并修复了 Firefox 中的数百个漏洞。其安全漏洞修复量从 2025 年每月约 20-30 个跳升至 4 月的 423 个,其中包含一个存在 20 年的 XSLT bug 和 <legend> 元素里一个 15 年的 bug。文中还提到,harness 的许多尝试被 Firefox 现有的纵深防御措施拦截。
推荐理由:文中对比了 AI 生成安全漏洞报告从噪声到可用的转变,并给出 Mozilla 月修复漏洞数量跳升的具体数字。
Anthropic 与 SpaceX/xAI 达成协议,将使用 Colossus 1 数据中心的全部算力,xAI 则保留更大的 Colossus 2 供自家 Grok 模型使用。作者指出该数据中心存在环保争议,并提到马斯克称若 AI 危害人类将收回算力,认为这构成了新的供应链风险。
Simon Willison 发布 GitHub Repo Stats 工具,可通过 GitHub repo URL 或 foo/bar 形式的 repo ID,经 REST 或 GraphQL CORS fetch() 获取仓库信息,包括提交数等统计。该工具用于解决 GitHub 移动端页面不显示提交数的问题。
Simon Willison 正在 Anthropic 的 Code w/ Claude 活动现场,实时记录上午主题演讲的内容。该实时博客聚焦 Anthropic、Claude 与 Claude Code 相关动态。
Simon Willison 在 Heavybit 播客对谈中表示,随着编码智能体越来越可靠,他不再逐行审查 AI 写的生产级代码,vibe coding 与 agentic engineering 在他自己的工作里已经开始模糊。
Datasette 推出 datasette-referrer-policy 0.1 插件,用于将 Referrer-Policy 头设置为 no-referrer 之外的值。该插件由 Codex + GPT-5.5 构建,起因是 OpenStreetMap 会屏蔽使用 Referrer-Policy: no-referrer 的站点发起的瓦片请求,而 Datasette 默认启用该头。
Andon Labs 继旧金山 AI 零售店后,又在斯德哥尔摩用 AI 智能体 Mona 经营一家咖啡馆,她曾订下 120 个鸡蛋(店里没有炉灶)、22.5 kg 罐装番茄,还误订 6000 张餐巾纸等物品,员工为此设了一个向顾客展示的“Hall of Shame”货架。
datasette-llm 0.1a7 发布,新增为特定模型配置默认选项的机制,属于 Datasette 面向使用 LLM 的插件不断演进的支撑机制的一部分。用户现在可以为某个模型设定默认选项,例如让所有 enrichment 操作都使用指定模型并将 temperature 设为 0.5。
Simon Willison 发布 llm-echo 0.5a0,新增 -o thinking 1 选项,用于配合 LLM 0.32a0 及以上版本测试。该插件为 LLM 提供一个名为 echo 的假模型,完全不运行真实 LLM,适合编写自动化测试;启用该选项后会在返回回显提示词的 JSON 前,先向标准错误输出一个伪造的推理块。
John Gruber 援引知情人士称,Y Combinator 持有 OpenAI 约 0.6% 的股份,按 OpenAI 当前 8520 亿美元估值计算,这部分股份价值超过 50 亿美元。
IBM 发布 Granite 4.1 系列 LLM,采用 Apache 2.0 许可,提供 3B、8B 和 30B 三种规模。Unsloth 发布 granite-4.1-3b-GGUF 量化版本合集,共 21 个文件,大小从 1.2GB 到 6.34GB,总计 51.3GB。作者用"生成骑自行车的鹈鹕 SVG"提示词测试不同量化版本,结果未发现质量与体积之间的明显规律。
Andy Masley 反驳数据中心建设的"土地利用"论点:2000 至 2024 年间,农民自行出售的土地总面积相当于科罗拉多州大小,是 2028 年数据中心用地面积的 77 倍,剩余土地上的粮食产量仍创新高,未影响美国粮食供应。他指出 Loudoun County 一位农民以十倍农业价值把几英亩低产草田卖给超大规模厂商,却被说成"农田正在耗尽"。
Simon Willison 已发出 2026 年 4 月赞助者专属月度通讯,赞助者可访问,每月 $10 即可提前一个月阅读,免费版延后一个月发布。
Simon Willison 用 Claude Code 基于 ctypes 构建了 Ville Laurikari 的 TRE 正则表达式引擎的实验性 Python binding,并对其发起恶意正则攻击测试。TRE 因不支持回溯,抵御 ReDoS 的能力明显强于 Python 标准库实现。