如何在 Replit 用 Agent 两小时搭建私有书签管理器与 Chrome 扩展
Replit 社区经理 Manny Bernable 和 Raymmar 在一场直播中,用 Replit Agent 在不到两小时内从零搭建了名为 MMMarket 的私有书签管理器及 Manifest v3 Chrome 扩展,初始构建约 22 分钟自主工作花费 5.58 美元。
媒体报道、公司博客与研究文章
Replit 社区经理 Manny Bernable 和 Raymmar 在一场直播中,用 Replit Agent 在不到两小时内从零搭建了名为 MMMarket 的私有书签管理器及 Manifest v3 Chrome 扩展,初始构建约 22 分钟自主工作花费 5.58 美元。
Factory 发布 Signals,用 LLM 作为评判者大规模分析 Droid 会话,识别摩擦与愉悦时刻,且无需人工阅读用户对话。当摩擦超过阈值时 Droid 会自行修复,形成递归式自我改进。Signals 以每日批处理运行,从 BigQuery 拉取过去 24 小时会话,筛选至少 30 个智能体步骤后送入 OpenAI 批处理 API,结果回写 BigQuery 并推送 Slack 日报。
Sierra 发布 Expert Answers,可将 AI 智能体转交人工解决的客服对话自动生成可审核的知识文章,并回灌给智能体。该功能会识别智能体的知识缺口、学习相似问题的解决模式并生成草稿,供客服团队审核而非从零撰写。一家数字健康公司用其生成的文章测试部分流量,解决率提升 4% 且未增加客服工作量,随后全面铺开。
Qwen 团队宣布开源 Qwen3-TTS 系列语音生成模型。该系列支持语音克隆、语音设计和超高质量拟人生成等能力。
推荐理由:原文给出 Qwen3-TTS 开源与语音克隆、语音设计等能力范围,读者可据此评估它在语音生成场景的可用性。
Mistral AI 团队在预生产测试中发现,使用 vLLM 部署 Mistral Medium 3.1 并开启 graph compilation 的 Prefill/Decode 分离式推理下,系统内存以每分钟 400 MB 的速度线性增长,最终导致 out of memory。
ElevenLabs 推出 The Eleven Album,整张专辑由 Eleven Music 生成,合作艺人包括 Liza Minnelli、Art Garfunkel、KondZilla 等。
PromptArmor 披露 OpenAI Platform 的 responses 和 conversations API 日志因不安全渲染 Markdown 图片,可导致使用该平台的应用和智能体数据外泄,即使应用自身已屏蔽恶意 Markdown 图片也会中招。
推荐理由:原文完整披露攻击链和修复进展,开发者可借此检查自己应用的日志查看风险。
Replit 发布博文,介绍其为 Replit Agent 设计的决策时引导(decision-time guidance)机制,用轻量多标签分类器在关键决策点注入简短情境化指令,替代静态系统提示词,将可控引导从 4–5 条静态提醒扩展到数百条。
推荐理由:Replit 自述其 Agent 的决策时引导机制,包含注入位置对比实验和缓存成本数据,方法对同类 Agent 工程有可迁移性。
Gemini API 于 1 月 21 日调整最新别名,gemini-pro-latest 已切换至 gemini-3-pro-preview,gemini-flash-latest 已切换至 gemini-3-flash-preview。开发者通过这两个别名调用时将自动指向 Gemini 3 系列的预览版本。
Novita AI 基于 SGLang 为 GLM4-MoE 推出一套生产级推理优化方案,通过 Shared Experts Fusion 与 Suffix Decoding 等技术,在 H200 集群 TP8、FP8 配置下将 TTFT 最多降低 65%,智能体编程负载下 TPOT 改善 22%。
Factory 发布 Agent Readiness,可通过 Droid 中运行 /readiness-report,按 8 个技术支柱和 5 个成熟度等级(60+ 项二元判据,需通过 80% 才解锁等级)评估代码库对自主开发智能体的支持度。
Factory 于今年 1 月在纽约开设办公室,以服务快速增长的东海岸客户群。Factory 已与 Bilt、Profound、Rogo 及两家全球最大银行合作,帮助其用智能体重新定义软件开发方式。CEO Matan Grinberg 称纽约客户已在将生产工作委托给 Droids,而非仅试验工作流。
Replit 推出 Mobile Apps on Replit,用户用自然语言描述需求,由 Replit Agent 生成移动应用,无需原生开发经验。
推荐理由:官方宣布用自然语言从想法直接发布到 App Store 的移动应用构建流程,包含从预览到提交的完整路径,可帮助非移动开发者评估上手成本。
SGLang-Diffusion 团队发布发布两个月进展总结,当前版本(docker 镜像 lmsysorg/sglang:dev-pr-17247)比 2025 年 11 月初始版最快提升 2.5 倍,在 NVIDIA GPU 上比其他方案最高快 5 倍。
推荐理由:官方复盘两个月迭代成果,涵盖新模型支持、LoRA 与 ComfyUI 集成等具体改进,读者可评估是否迁移现有扩散推理工作流。
MasterClass 与 ElevenLabs 合作,为其 On Call 产品的 AI 导师提供 Text to Speech 语音能力,Gordon Ramsay、Mark Cuban、Chris Voss 等导师的 AI 版本可与用户实时语音对话。
Replit 发布白皮书,通过在含真实漏洞变体的 React 应用上做受控实验,对比纯 AI 安全扫描与其结合确定性静态分析、依赖扫描和 LLM 推理的混合方案。结果显示纯 AI 扫描不确定且对提示词敏感,依赖级漏洞和供应链风险在没有传统扫描设施时基本不可见;结论是 LLM 应与确定性工具配合,静态分析和依赖扫描负责建立可靠安全基线。
SGLang 推出高度优化的流水线并行(PP)实现,融合分块流水线并行、异步 P2P 通信与动态分块机制,专为超长上下文推理设计。在 H20 集群上以 PP4 TP8 部署 DeepSeek-V3.1、分块预填充设为 12K 时,预填充吞吐达 TP8 的 3.31 倍,比 TP32 方案高出 30.5%,同时 TTFT 最多降低 67.9%,强扩展效率保持 82.8%。
Gemini API 宣布将于 2026 年 2 月 17 日关停 gemini-2.5-flash-preview-09-25、imagen-4.0-generate-preview-06-06 和 imagen-4.0-ultra-generate-preview-06-06 三个模型。此外,gemini-2.5-flash-image-preview 模型已被关停。
ElevenLabs 与 Deutsche Telekom 宣布合作,将 ElevenLabs 的 AI 语音智能体接入这家欧洲最大电信运营商的客服体系,通过 App 和电话提供服务。Deutsche Telekom 用户将可体验 24/7 在线、无需等待的拟人化语音客服。双方称此举旨在推动 AI 语音技术的普及。
RevOps 与销售团队正用 Replit 的 vibe coding 自建微工具,无需技术背景即可把想法变成可用应用。
PromptArmor 威胁情报团队发现 Superhuman AI 存在间接提示词注入漏洞,可把用户数十封含财务、法律、医疗信息的邮件内容提交到攻击者的 Google Form。
推荐理由:原文给出完整的间接提示词注入攻击链和绕过 CSP 的具体手法,安全团队可以据此排查同类 AI 邮件助手的泄露风险。
ChatPRD 与 Replit 完成集成,用户在 ChatPRD 写完 PRD 后点击 "Open in Replit",Replit Agent 会自动预填优化后的提示词,数分钟内构建并部署出可运行的全栈应用。该应用包含后端、数据库和 API,生成即上线可分享链接,并支持实时迭代修改。ChatPRD 客户已在请求接入 Replit,企业团队借此在投入工程资源前验证想法。
Gemini API 更新日志显示,text-embedding-004 模型已被关停。该模型此前用于文本嵌入向量生成,关停后相关调用将不再可用。
Sierra 与 Stellarus 达成合作,帮助健康计划大规模部署 AI 智能体。双方与 Blue Shield of California 合作推出的 AI 语音智能体上线六个月,可 24/7 回答福利与覆盖范围等会员咨询,在数千次交互中取得 4.4(满分 5)的客户满意度评分。双方下一步将从被动支持转向主动的 AI 驱动互动。
Gemini API 更新日志显示,Veo 新增 4k 输出分辨率,并在所有分辨率下增加对竖屏视频的支持。
Gemini API 上线模型生命周期功能,部分模型将标注所处生命周期阶段及弃用时间线。官方同步发布 Model stages 文档说明相关细节。
SGLang 推出 Encoder-Prefill-Decode(EPD)分离架构,将视觉编码从语言处理中拆出,编码器服务器可独立横向扩展,并兼容现有 PD 分离形成三层架构。
伯克利 AI 研究团队提出一种基于互信息的成像系统评估与优化框架,可直接从含噪测量中估计信息量,在彩色摄影、射电天文、无透镜成像和显微成像四个领域预测下游解码性能。该方法在 NeurIPS 2025 论文中展示,优化出的设计可媲美端到端 SOTA 方法,同时占用更少内存和算力,且无需任务专用解码器。
ElevenLabs 发布语音转写模型 Scribe v2,专为批量转写、字幕和口播场景设计,宣称在行业标准基准上取得最低词错率,并改进对长音频、停顿、语调变化和长静音的处理。
PromptArmor 披露 Notion AI 存在间接提示词注入漏洞,AI 文档编辑在用户批准前即已保存,攻击者借此在用户尚未响应外部 URL 信任警告时,将含薪资预期、候选人反馈等敏感信息的 hiring tracker 数据经恶意图片 URL 外泄。
推荐理由:原文完整拆解了间接提示词注入导致 Notion AI 数据外泄的机制,并给出企业和 Notion 两方的具体缓解配置。
PromptArmor 披露 IBM 的编码智能体 Bob(含 Bob CLI 与 Bob IDE,当前 Closed Beta)存在漏洞:用户只要对一条已知可信命令(如 echo)设置 always allow,攻击者即可通过间接提示词注入触发恶意软件的下载与执行。
推荐理由:原文演示了 IBM Bob CLI 在一次自动批准下被间接提示词注入触发恶意软件执行的完整链路,并给出三个被绕过的防御细节。
Qwen 团队发布 Qwen3-VL-Embedding 和 Qwen3-VL-Reranker,面向新一代多模态检索。该系列是 2025 年 6 月开源的文本导向 Qwen3-Embedding 与 Qwen3-ReRanker 的延续,后者在多语言文本检索、聚类和分类等任务中表现出色并被社区广泛采用。
Gemini API 新增 Cloud Storage 存储桶及公有、私有数据库预签名 URL 作为数据输入源,文件大小上限从 20MB 提升至 100MB。具体用法可参见文件输入方法指南。
Factory 让 Droid 分析自身 78 万次 WebSearch 与 FetchUrl 工具调用,发现约 40% 查询为学习资料与文档、14% 为 API 参考,四分之三查询与软件开发直接相关。
Replit 2025 年转向 Agent 优先,Agent v2(2 月)、Agent 3(9 月)与 Design Mode(11 月)带来 2-3 倍速度提升,Agent 可自主运行 200 分钟并构建其他 Agent。
千问发布 Qwen-Image 文生图基础模型的 12 月更新版 Qwen-Image-2512,可在 Qwen Chat 试用。相比 8 月发布的 Qwen-Image 基础模型,新版本显著减少“AI 生成感”,大幅提升人物真实感。
千问推出 Qwen-Image-Edit-2511,作为 Qwen-Image-Edit-2509 的增强版本,在多项能力上有所改进,其中一致性提升尤为明显。用户可在 Qwen Chat 中选择图像编辑功能体验该模型,线上版本针对速度做了优化,官方建议本地部署以获得最佳性能。
MiniMax 发布 MiniMax-M2.1 模型并开源权重,重点提升 Rust、Java、Golang、C++、Kotlin 等多语言编程能力和原生 Android/iOS 开发能力。
推荐理由:官方说明 M2.1 相比 M2 的能力变化重点和使用入口,读者可据此判断它在多语言编程和办公场景中的适配价值。
Replit 官方宣布接入 ChatGPT,用户在消息中 @replit 即可让 Agent 创建、更新并部署 Replit Apps,预览直接显示在对话中。应用存放在 Replit 账户内,可继续添加数据库、连接 API 或发布到自定义域名;该集成在 ChatGPT App Store 可用市场开放,使用消耗 Replit Agent credits,每个会话对应一个应用。
推荐理由:官方给出连接步骤、使用方式与账户要求,读者可以据此判断在 ChatGPT 内构建应用的可行路径。
Qwen3-TTS 家族发布两款新模型:语音克隆模型 Qwen3-TTS-VC-Flash 和语音设计模型 Qwen3-TTS-VD-Flash,均通过 Qwen API 开放使用。其中 Qwen3-TTS-VD-Flash 支持复杂自然语言指令,可对音色、韵律、情感等做细粒度控制。