Harvey 借助 GPT-6 Astra 将法律上下文转化为更强草稿
Harvey 借助 GPT-6 Astra 生成结构更清晰、更贴合上下文的法律文档,让律师得以专注策略性工作。
Harvey 借助 GPT-6 Astra 生成结构更清晰、更贴合上下文的法律文档,让律师得以专注策略性工作。
Cursor 推出 Rollouts 和 Security Reviewer 两款软件开发 Bots。
推荐理由:官方说明了两款 Bot 的具体工作机制和启用入口,读者可以对照自身部署与安全审查流程评估适用性。
千问(Qwen)推出 Qwen Intelligence,首发三个 Agent:Mobile Planner Agent 居 MobilePA-Bench 等榜单第一。
免费两周!Hy Image3.5 预览版已在 OnSolo 上线。短剧角色设定图。全动态视频游戏素材。关键帧。角色在每一集中保持一致。编辑是精修而非重来。
Hy Image3.5 preview is on OnSolo. Exclusive. 5 refs. 2K. 2 weeks Members free.
作者在云栖大会参加千问办公活动后,评析其新发布的「企业上下文」产品,该产品把企业分散在群聊、文档、知识库的信息整理成结构化上下文供 Agent 提取,并仰赖新模型 Qwen3.8-Omni-Flash 做全模态理解。
ChatGPT Ads 扩展至东南亚和台湾,使符合条件的企业可在超过 60 个国家和地区触达用户。
Google 宣布 Antigravity SDK 支持本地工作流,首发支持通过 Google AI Edge 的 LiteRT 运行 Gemma 4 26B A4B,可完全离线提供智能体能力,建议机器配备 24GB 以上 VRAM 或统一内存。
推荐理由:原文给出本地运行智能体的具体配置方法和混合编排演示数据,开发者可以直接照此把智能体工作流搬到本地 GPU 上。
GPT-6 改进了提示词缓存,带来更高的缓存命中率、新的诊断工具、显式断点以及可降低延迟与成本的控制项。
GPT-6 Sol 和 Luna 两个模型已在 Conductor 上线,作者称今天是重要的一天。
Simon Willison 发布 llm 0.36。该版本更新于 9 月 22 日发布,属于其 llm 命令行工具系列。原文未披露具体功能变更与参数细节。
Simon Willison 发布 llm-anthropic 0.29,这是 LLM 工具接入 Anthropic 模型的插件更新。原文未披露该版本的具体功能、参数或可用性细节。
Claude Code v2.1.280 加入 Claude Opus 5.5(claude-opus-5-5)作为默认 Opus 模型,1M 上下文,$4/$20 per Mtok,cache reads $0.20/Mtok;Pro 和 Team Standard 计划默认模型由 Sonnet 改为 Opus。
推荐理由:发布日志列出 Opus 5.5 成为默认模型及其定价上下文,并包含大量修复与 VSCode 新对话框,读者可对照更新自己的工作流。
在 Tesla 里对 @bot 说话!点咖啡、管理日程,甚至预订行程
.@Grok in your Tesla can now do meaningful work for you With Connectors, you can manage your inbox, clean up your calendar, or talk through existing files/chat/tasks – all hands-free
Claude API 的缓存诊断功能结束 beta,不再需要 cache-diagnosis-2026-04-07 beta header。在 Messages 请求中加入 diagnostics 对象即可启用,仍发送该 header 的请求行为不变;POST /v1/messages 的响应现在始终包含 diagnostics 字段,未启用时为 null。
CodeRabbit、Power Digital 和 ThoughtSpot 通过 Claude Marketplace 用已有的 Anthropic 承诺额度扩容 Vercel 和 Snowflake。
Anthropic 宣布 Claude Marketplace 上线,把插件与连接器、智能体与产品以及服务合作伙伴聚合到一处。
推荐理由:Anthropic 官方宣布 Marketplace 上线,说明客户可用已承诺消费额度购买合作方工具,读者可据此了解生态采购方式的变化。
Anthropic 成立生命科学研究组和实验室,宣布 Claude 智能体在约 950 个智能体、21 小时、2.1 亿 token 的搜索后,自主发现一种与 DNA 重复序列相关的新型酶系统,命名为 array-associated reverse transcriptases(ART)。
推荐理由:原文给出 Claude 智能体自主发现新酶系统的过程细节和预印本,读者可以据此了解 AI 驱动生物学研究的实际工作方式。
Simon Willison 发布 llm-typesafe 0.1a0 插件,让 LLM 工具支持 TypeSafe AI 新推出的 Jev 模型。
🎨 Hy Image3.5 preview 已在 Miora 上线。编辑时保留已经奏效的部分——同一画布,你的品牌规则已被记住。免费两周。
Hy Image3.5 preview is live on Miora. FREE through October 7. Campaign visuals. Product scenes. Storyboards. Game concepts. Up to 2K. Text-to-image and image-to-image. Try it: https://miora.design/
NVIDIA 在 ROSCon 大会上发布 Isaac ROS 5.0,新增智能体工作流与平台支持,支持 ROS Lyrical 和 Ubuntu 24.04。
Parallel 借助 GPT-6 Astra 让智能体研究并综合劳动力市场数据,耗时和成本均降至此前模型的一半。
OpenRouter 用 Banking77 测试集的 3,080 条客服语句对比 Jev 1.13 和 Claude Opus 5 的意图分类能力。
推荐理由:原文给出了同一测试集下的准确率、延迟和成本对比,以及置信度级联方案,可用于判断小判断模型能否替代前沿模型。
Google AI 订阅用户现可直接获得 Colab 高级权益,包括优先使用更快的加速器和更强算力的机器。Google AI Ultra 订阅者还可解锁不间断后台执行和 Premium GPU 访问,长时间训练无需保持浏览器标签页开启。该权益将在未来几周内向 Colab 支持国家的 Google AI 订阅用户逐步推送,已有 Colab 订阅不受影响。
OpenRouter 推出 Batch API,提交批量请求后供应商可在 24 小时窗口内完成,per-token 价格通常为常规价的 50% 或更低,已支持 70 多个模型。
推荐理由:官方给出了实测的批次完成时长分布和提交时段差异,便于读者判断批量推理能否接入现有工作流。
Hugging Face 宣布 transformers 支持通过 from_pretrained 加载 GGUF 量化模型,复用 ggml 的 Metal 内核,初始聚焦 Apple Silicon 上的 Qwen3.5 架构。
推荐理由:原文给出加载方式、性能对比数据和方法论,读者可据此判断在 Mac 上用 transformers 跑 GGUF 的可行路径。
Googlebook is officially here! I’ve been so excited to share the details with the world. Today, many of us rely heavily on laptops to get work done, but we think there is an opportunity to rethink the category to address the needs of people today. So we brought the best of ChromeOS and Android to create a new platform for laptops. Our initial focus with Googlebook is to deliver an amazing laptop that feels awesome for Android phone users. Here’s what to know about Googlebook 🧵👇
Anthropic 与 CEPI、WHO AFRO、INRB 合作,在刚果(金)Bundibugyo 型埃博拉疫情(近 8,000 确诊病例中近半死亡)中部署 Claude 辅助疫情响应。
Higgsfield AI 借助 GPT-6 Astra,一天内上线新视频功能,让小型企业更轻松地制作视频广告,并更快将新创意工具推向市场。
OpenAI Academy 新增面向员工、开发者、管理者、教育工作者和学生的新学习路径,用于培养和展示实用 AI 技能。
感谢 @sgl_project 的 day-0 支持!🙌 SGLang-Diffusion 现已支持 Qwen-Image-2.1:文生图、多图编辑,以及透明 RGBA 输出。快来试试!🎨
Day-0 support for @Alibaba_Qwen’s Qwen-Image 2.1 is here in SGLang-Diffusion! 🖥️ Native precision on a single RTX 4090 24GB with CPU offload - 1024×1024 generation in 18.7s and image editing in 21.7s with 22.7 GiB peak GPU memory during requests. - On an RTX PRO 6000 96GB: 8.0s generation and 9.6s editing. 🎨 Text-to-image, multi-image editing, and transparent RGBA output—all with one checkpoint. ⚡ Native inference with TP/SP, LoRA, and OpenAI-compatible APIs. 40 denoising steps, one image per request, warmed HTTP latency including PNG output. No quantization. Cookbook and GPU-specific commands below 👇
Descript 借助 OpenRouter 和 Anthropic 的 Slack 集成 Claude Tag,把新模型评测从几小时工作加一周等待压缩到一两小时内完成,无需再占用工程师排期。
V7 借助 GPT-5.6 Luna 将成本降低 78%,同时提升准确率。该系统利用 GPT-5.6 把分散的公司文件转化为智能体可用的上下文,以完成复杂且带来源链接的工作。
Hugging Face 发布 tokenizers v1 候选版本,单线程编码速度在十个模型族上比 v0.23 快 3 到 30 倍(Apple M4 Max,低端 t5-base,高端 gpt2),八线程扩展达线性 76%,且 token ID 与旧版完全一致。主要改动包括用 SIMD 位流切分替代正则、线程本地词缓存、免分配的合并循环和按批模型调用,候选版已在 crates.io 提供。
TypeSafe 于 2026 年 9 月 15 日发布早期访问版决策模型 Jev(当前版本 1.13),现已可通过 OpenRouter 调用。Jev 是非生成式决策模型,只接受文本输入,返回 Choice、Score、Noul 三种类型化答案并附带校准概率,无自由文本输出。
推荐理由:原文给出 Jev 三个返回原语、真实 API 响应和定价细节,开发者可据此判断是否用它替换现有 LLM 加正则的分类流程。