跳到正文

网站与博客

媒体报道、公司博客与研究文章

当前显示全部 AI 相关新闻
按账号或来源筛选(93)
全部网站与博客新闻IT Home8971 条Simon Willison360 条OpenAI News317 条TechCrunch · AI301 条The Decoder275 条The Verge · AI161 条Hugging Face Blog151 条Claude Blog140 条elsewhere articles116 条Google Research108 条OpenRouter Announcements103 条Mistral AI89 条Databricks Blog86 条Tomer Tunguz84 条Sierra Blog67 条Anthropic Newsroom65 条Gary Marcus64 条Claude Platform release notes62 条Runway News62 条Gemini API 更新日志60 条LMSYS Blog60 条Manus Blog60 条Together AI Blog60 条Google DeepMind58 条NVIDIA Blog53 条a16z News49 条Apple Machine Learning Research48 条LangChain Blog48 条Suno Blog48 条ByteByteGo46 条ElevenLabs Blog45 条Google Blog: AI41 条Qwen Blog40 条Google Developers Blog35 条Cursor Blog34 条Google Cloud: Databases32 条Microsoft AI News32 条Linear Now30 条AWS Machine Learning Blog29 条Ars Technica · AI27 条Dwarkesh Patel27 条Nathan Lambert: Interconnects26 条Latent Space24 条DeepSeek API updates23 条Sakana AI Blog23 条Anthropic Research21 条Import AI21 条AI as Normal Technology20 条ByteDance Seed Papers17 条MIT Technology Review · AI16 条GitHub Blog · AI & ML12 条MiniMax Blog12 条Meta Engineering11 条Sam Altman Blog11 条Berkeley AI Research10 条Black Forest Labs Blog10 条MarkTechPost10 条Microsoft Research10 条xAI:News9 条Cohere 产品与研究博客8 条Epoch AI:Gradient Updates8 条Factory 研究 / 产品8 条Google AI:DEV 作者专属8 条OpenClaw Blog8 条Recode China AI8 条Redwood Research Blog8 条Replit Blog8 条SemiAnalysis 长文8 条Understanding AI8 条404 Media7 条Amazon Science7 条Artificial Intelligence News7 条Every latest articles7 条Exponential View7 条Liquid AI 模型与工程博客7 条LlamaIndex:产品、工程与评测7 条PromptArmor:Threat Intelligence7 条PyTorch Blog7 条Thinking Machines Lab Blog7 条Preferred Networks:AI 研究与产品6 条ByteDance Seed Research5 条ChinaTalk5 条Chips and Cheese4 条Canary Media:Data Centers2 条Claude YouTube2 条CMU Machine Learning Blog1 条MarkTechPost · 历史来源118 条xAI News · 历史来源73 条Artificial Intelligence News · 历史来源54 条Claude YouTube · 历史来源46 条Ars Technica: AI · 历史来源19 条GitHub Blog · 历史来源17 条Lilian Weng's Log · 历史来源2 条
13,334 条AI 相关新闻 · 最新在前
1月29日周四
1月28日周三
  1. ElevenLabs Blog54

    Revolut 采用 ElevenLabs Agents 强化客服,解决工单时间缩短超 8 倍

    Revolut 部署 ElevenLabs Agents 作为英国和欧洲客户的语音客服第一线,覆盖超 400 万客户,支持 30 多种语言并实时切换。智能体解决工单不到 5 分钟,此前人工处理平均耗时 8 倍以上,超 99.7% 的通话顺利完成。Revolut 保留编排和业务逻辑控制权,方案满足 PCI 合规与零留存要求,并计划向全球扩展。

  2. Mistral AI70

    Mistral 发布 Mistral Vibe 2.0 终端编码智能体并调整 Devstral 2 定价

    Mistral AI 发布终端原生编码智能体 Mistral Vibe 2.0,由 Devstral 2 模型家族驱动,新增自定义子智能体、多选澄清、斜杠命令技能和统一智能体模式。

    推荐理由:官方公告给出 2.0 的功能清单、订阅方案和 Devstral 2 API 定价,读者可以据此评估是否把它纳入自己的终端开发工作流。

1月27日周二
1月26日周一
1月23日周五
  1. Sierra Blog35

    Sierra 推出 Expert Answers:把客服对话转化为 AI 智能体的复利知识

    Sierra 发布 Expert Answers,可将 AI 智能体转交人工解决的客服对话自动生成可审核的知识文章,并回灌给智能体。该功能会识别智能体的知识缺口、学习相似问题的解决模式并生成草稿,供客服团队审核而非从零撰写。一家数字健康公司用其生成的文章测试部分流量,解决率提升 4% 且未增加客服工作量,随后全面铺开。

1月22日周四
1月21日周三
1月16日周五
  1. LMSYS Blog63

    SGLang-Diffusion 两个月迭代:推理速度最高提升 2.5 倍并集成 ComfyUI

    SGLang-Diffusion 团队发布发布两个月进展总结,当前版本(docker 镜像 lmsysorg/sglang:dev-pr-17247)比 2025 年 11 月初始版最快提升 2.5 倍,在 NVIDIA GPU 上比其他方案最高快 5 倍。

    推荐理由:官方复盘两个月迭代成果,涵盖新模型支持、LoRA 与 ComfyUI 集成等具体改进,读者可评估是否迁移现有扩散推理工作流。

1月15日周四
  1. LMSYS Blog48

    SGLang 流水线并行如何扩展至百万级 Token 上下文

    SGLang 推出高度优化的流水线并行(PP)实现,融合分块流水线并行、异步 P2P 通信与动态分块机制,专为超长上下文推理设计。在 H20 集群上以 PP4 TP8 部署 DeepSeek-V3.1、分块预填充设为 12K 时,预填充吞吐达 TP8 的 3.31 倍,比 TP32 方案高出 30.5%,同时 TTFT 最多降低 67.9%,强扩展效率保持 82.8%。

1月14日周三
1月13日周二
1月12日周一
1月10日周六
  1. Berkeley AI Research47

    伯克利提出信息驱动成像系统设计框架,登 NeurIPS 2025

    伯克利 AI 研究团队提出一种基于互信息的成像系统评估与优化框架,可直接从含噪测量中估计信息量,在彩色摄影、射电天文、无透镜成像和显微成像四个领域预测下游解码性能。该方法在 NeurIPS 2025 论文中展示,优化出的设计可媲美端到端 SOTA 方法,同时占用更少内存和算力,且无需任务专用解码器。

1月9日周五
1月8日周四
12月31日周三
12月23日周二
12月20日周六
  1. Linear Now48

    设计不只是写代码:Linear 谈 AI 时代设计师与工程师的角色演变

    Linear 发文讨论“用代码做设计”之争,认为把设计等同于代码是过度简化,真正的问题是 AI 与新工具下设计师和工程师的角色如何演变,是否会出现“head of craft”这类新职位。文章主张先厘清问题本身再谈方案,并指出代码虽是软件的载体,但并非所有决策都应在代码中做出。

12月19日周五
  1. LMSYS Blog61

    SGLang 发布扩散大语言模型框架并 Day-0 支持 LLaDA 2.0

    Ant Group DeepXPU 团队与 SGLang 团队在 SGLang 中实现扩散大语言模型(dLLM)框架,Day-0 支持 LLaDA 2.0。方案复用现有 Chunked-Prefill 机制,无需改动 SGLang 核心架构,支持自定义扩散解码算法、流式输出、张量并行和 CUDA graph 优化。

    推荐理由:原文给出基于 Chunked-Prefill 实现 dLLM 支持的设计细节和实测吞吐数据,读者可据此评估 SGLang 上扩散模型的推理可行性。

12月17日周三
  1. LMSYS Blog62

    LMSYS 发布 Mini-SGLang:5k 行代码的高性能 LLM 推理引擎

    LMSYS 推出源自 SGLang 的轻量级推理框架 Mini-SGLang,代码仅 5k 行 Python,保留 Radix Attention、Chunked Prefill、Overlap Scheduling、Tensor Parallelism 等核心优化,并提供 OpenAI 兼容 API 和开箱即用的 Llama-3、Qwen-3 支持。

    推荐理由:官方介绍这款仅 5k 行代码的推理引擎保留了哪些关键优化,以及如何用它学习和做研究原型。

  2. Gemini API 更新日志76

    Google 发布 Gemini 3 Flash Preview(gemini-3-flash-preview)

    Google 在 Gemini API 更新日志中宣布推出 Gemini 3 Flash Preview(gemini-3-flash-preview),定位为以更低成本提供对标更大模型的快速前沿性能。新模型升级了视觉与空间推理以及智能体编码能力,并附带多模态函数响应、带图像的代码执行等新功能文档。

    推荐理由:官方日志给出新模型的定位、成本与新增功能入口,便于评估其在现有 Gemini API 工作流中的替换价值。