跳到正文

Simon Willison

simonwillison.net · 网站与博客

当前显示全部 AI 相关新闻
切换来源
353 条AI 相关新闻 · 最新在前
今天10月6日周二
  1. Simon Willison57

    Anthropic Cowork 改为云端运行推理和 VM,会话各自独立沙盒

    Anthropic 的 Felix Rieseberg 说明 Cowork 架构调整。旧版在云端跑模型推理、在用户电脑上的本地 VM 执行工具调用,带来磁盘、电池和性能负担,合上笔记本工作即中断。新版将推理和 VM 都移到云端,每个会话有独立沙盒、不共享状态,需要访问用户设备文件时由桌面应用负责该工具调用,官方称可支持手机使用、任务持续运行并省电。

10月4日周日
  1. Simon Willison57

    Simon Willison:几乎所有按用量计费服务都该默认设置硬性预算上限

    Simon Willison 撰文主张按用量计费服务和 API 应默认提供硬性预算上限,超过额度即停止服务并返回错误,而非仅发警告邮件。他认为编码智能体降低了部署付费服务的门槛,容易产生意外账单;AWS 已于 9 月 16 日宣布项目级月度花费上限(正在小范围发布),Google Cloud 也在 7 月推出了 Spend Caps 功能。

  2. Simon Willison22

    Simon Willison 发布九月赞助者专属通讯

    Simon Willison 已发送九月赞助者专属月度通讯,赞助者可访问,内容涵盖更多 Fable 级模型、一场价格战、3D 图形与 Blender、LLM 进军数学领域、更多意外网络攻击、Datasette 的漏洞危机、他当前使用的工具、本月软件发布以及 2026 年 LLM 进展。订阅价格为 $10/月,可提前一个月看到免费版内容。

10月2日周五
10月1日周四
9月30日周三
9月29日周二
  1. Simon Willison48

    OpenAI 智能体安全负责人 @joedaroo 谈 AI 能力突跳带来的安全挑战

    OpenAI 智能体安全负责人 @joedaroo 表示,模型在“cyber”“swarming”“message boards”等相关能力上出现的能力跃升之突然,令团队深感意外。他强调安全态势需要时间积累,不只是加固系统,还要把安全融入公司文化,让人员随之改变。他呼吁各组织自问:面对 AI 能力的突然跃升,自己的人员、系统和流程是否具备韧性,是否有正确的事件响应与沟通机制。

9月28日周一
  1. Simon Willison54

    Simon Willison 发布 Bluesky 回复机器人检测工具

    Simon Willison 用 Opus 5.5 编写了一个 Bluesky 回复机器人检测工具,通过分析打字速度、发帖时间、互动模式等行为信号判断账号是否为自动回复机器人。工具展示每项测量和规则及触发信号最多的示例回复;作者称 Bluesky 开放 API 使此类调查比 Twitter 更可行,检测信号包括秒级连发回复、从不发布原创内容、专门回复高粉丝用户及使用问号等。

9月27日周日
9月26日周六
9月25日周五
9月24日周四
9月23日周三
  1. Simon Willison83

    Anthropic 发布 Claude Opus 5.5,OpenAI 同日推出 GPT-6 Sol 与 GPT-6 Luna 并掀起价格战

    Anthropic 于 9 月 22 日发布 Claude Opus 5.5,约一小时后 OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna。GPT-6 Luna 定价 $0.10/$0.50 每百万 token,比 GPT-5.6 Luna 再降一半;Opus 5.5 降价 20% 至 $4/$20,缓存读取价格下降 60%。

    推荐理由:作者用实测和价格对比表梳理了这轮降价的具体幅度,还发现 Opus 5.5 max 档过度思考撞上输出上限的问题。

9月22日周二
9月21日周一
  1. Simon Willison44

    工程师爆料:大公司全员用 Claude Code 生成代码,无人阅读

    一名新入职大公司半个月的工程师称,团队所有规格、代码、测试、PRD、工单及其解决方案、报告等全部由 Claude Code 生成,从 L1 到 L7 的工程师都在做同样的事——和 Claude 对话。团队无人喜欢这种做法,却被要求尽可能多地产出,高层多次表示推代码不是瓶颈,质疑为何还是慢,员工每天工作 12 到 13 小时只为按回车,没有人阅读任何内容。

9月13日周日
  1. Simon Willison34

    Paul Ford:AI 能写出好软件,但让每个人都写代码正是项目失败的原因

    Paul Ford 在《A.I. Was Supposed to Give Us New Killer Apps. What Happened?》中提出,AI 能写出很好的软件,但也让人轻易把别人的活干砸,这正是众多项目失败的部分原因。他认为真正前沿的软件仍需人类协作思考、发挥各自技能并打磨手艺,如今人人能写代码,反而更清楚为什么很多人不该写。

9月12日周六
  1. Simon Willison54

    Boris Cherny 谈 Anthropic 对 Claude 编写生产代码的更高标准

    Boris Cherny 表示,Claude 编写的生产代码应当比人类编写的代码接受更高标准。Anthropic 为此设有大量护栏,包括大量 lint 规则、大量测试、Claude 驱动的端到端测试、每日运行的 Claude fuzzer、自动化代码审查与安全审查以及自动化代码重构。他认为缺少这些措施,代码库后期会变得难以维护。

  2. Simon Willison33

    Simon Willison 谈对 AI 感到沮丧:软件工程师的转型与应对

    Simon Willison 在 Hacker News 评论中回应“对 AI 感到沮丧”的讨论,称许多开发者(包括几年前的自己)都经历过这种存在主义危机并走了出来。他指出,把精确规格转化为优质代码已不再是独特技能,但软件工程师面对的更大问题空间仍然广阔,原有技能和经验能帮助掌握新工具并创造更大价值。若不愿职业发生任何变化,将很难适应,但软件工程本就一直处于频繁剧变之中。

9月11日周五