跳到正文

Kimi / 月之暗面

月之暗面 Kimi 系列模型与产品动态:K 系列开源模型、长上下文技术与产品演进的追踪。

当前仅显示精选新闻
38条精选相关主题千问 QwenDeepSeekMiniMax

最新精选

第 1–20 条 · 共 38 条
10月4日周日
  1. 量子位 · 微信公众号67

    FDE岗位为何爆火:月薪5万的前线部署工程师都做什么

    量子位访谈6位FDE从业者,梳理这一岗位的分工与现状。海外方面,Anthropic宣布投资1亿美元在2027年底前培训1万名FDE,AWS拿出10亿美元组建FDE部门;国内Kimi联合IT服务商共建FDE队伍,腾讯云推出FDE工程师认证。

    推荐理由:通过访谈多位从业者还原FDE的真实工作流与商业化路径,读者可以借此理解这个岗位为何在AI时代变成咨询与驻场的混合体。

10月2日周五
9月30日周三
  1. AI前线 · 微信公众号81

    OpenAI DevDay发布dots、Space与GPT-6.1 Sol,Codex接入GLM与Kimi,Pro 200额度腰斩

    OpenAI在DevDay上发布由GPT-6 Astra驱动的24小时个人智能体dots、协作套件Space与Pages,以及主打长程任务的GPT-6.1 Sol,其缓存价格降至0.10美元/百万Token。

    推荐理由:汇总了OpenAI DevDay多项发布的具体额度数字、定价与权限设计,还给出Pro 200降配等社区争议细节。

9月11日周五
  1. @thexpin71

    Anthropic 称已阻止未经授权使用 Claude 训练竞品模型的行为,指控阿里在 5 月至 7 月产生 151M+ 次交互,Moonshot 为 23M+ 次。它还称 DeepSeek 在 14 天内进行了 12M+ 次蒸馏攻击,并指 Moonshot 与 DeepSeek 在用户不知情下将客户请求转发给 Claude,部分含敏感数据。三家公司未立即回应 CNBC。

    推荐理由:Anthropic 指控阿里、Moonshot 与 DeepSeek 未授权用 Claude 训练竞品模型,并给出各家调用量数字,可用于观察模型蒸馏争议的走向。

9月9日周三
  1. @thexpin65

    美国 NSA、FBI 与 CISA 指控 DeepSeek、月之暗面、阿里巴巴、MiniMax、阶跃星辰等公司自至少 2024 年起以工业规模从美国模型中提取知识。这些机构称相关公司通过多个渠道提交请求以绕过规则,用于提升数学和编码能力。授权情况下的知识蒸馏本身合法,争议集中在访问权限与同意问题上;美方敦促美国开发者立即行动并共享情报,涉事公司暂未回应。

    推荐理由:美国三家机构指控多家中国公司以蒸馏方式大规模提取美国模型能力,争议焦点落在授权与访问同意上。

9月5日周六
  1. 虎嗅APP · 微信公众号79

    虚构的百亿份额:投资人为抢 DeepSeek 融资额度落空

    《财经》杂志报道,投资人追逐 DeepSeek 新一轮融资份额数月,最终发现嘉兴时远、青岛浩正等机构兜售的通道份额均未出现在首轮融资交割名单中。多位参与交易人士称,DeepSeek 最新估值约5000亿元,计划在第二轮融资500亿元,并要求投资者锁定期五年。月之暗面已于8月14日声明不存在所谓的朋友基金、老股额度或授权中介,并已就虚假融资乱象向公安机关反映。

    推荐理由:报道还原了围绕 DeepSeek 与月之暗面份额交易的虚假通道和高额费率细节,呈现一级市场 AI 融资的信息不对称。

9月4日周五
9月2日周三
  1. @thexpin68

    据LatePost独家报道,Kimi母公司月之暗面本周向香港联交所保密提交A1申请,正式启动IPO流程。Kimi回应称不对市场传闻置评,目前无信息可披露。同期该公司据报以500亿美元pre-money估值进行新一轮融资,该轮可能是其IPO前的最后一轮融资。

    推荐理由:报道给出月之暗面在港交所保密递表及新一轮估值,读者可据此跟踪其上市节奏与融资安排。

8月29日周六
  1. LMSYS Blog60

    SGLang 发布 SSD Expert Pack,在消费级硬件上运行 DeepSeek-V4-Flash 和 Kimi-K3

    SGLang 将 SSD-LLaMA 的核心思路引入 MoE 推理,把放不进 VRAM 和内存的路由专家权重放在 NVMe SSD 上,通过 Expert Pack 连续布局、O_DIRECT 直接 I/O、pinned 暂存和 GPU 缓存,只加载 router 选中的专家。

    推荐理由:原文给出完整机制说明和单卡实测数据,读者可以据此评估 NVMe SSD 承载超大 MoE 模型的可行性。

8月26日周三
  1. AI前线 · 微信公众号77

    OpenAI 公布自研推理芯片 Jalapeño 实测结果,多项指标超过英伟达 GB300

    OpenAI 公布自研推理芯片 Jalapeño 的实测结果,在 GPT-OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T 上,峰值每瓦吞吐量达到对比系统的 1.5 至 1.9 倍,端到端延迟优于对手 1.7 至 3.6 倍。

    推荐理由:OpenAI 公布自研推理芯片的实测对标数据,可看到模型公司自研算力对现有 GPU 与软件生态的实际冲击。

  2. @kimmonismus71

    OpenAI 在关于 Jalapeño 芯片的博客中披露,GPT-Astra 用 Codex 编写并优化底层 kernel,两个月内把三个原本不在计划内的开源权重模型带到该芯片上的高性能。在选定的 attention 和 MoE 模块上,AI 生成的实现比现有人工专家代码快 1.5–1.8 倍,这些数字只适用于选定模块而非完整模型。引用的推文还提到,Jalapeño 在 GPT-OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T 上实现 1.5–1.9 倍每瓦 AI 吞吐与 1.7–3.6 倍更低的端到端延迟,OpenAI 计划 2026 年底开始部署。

    引用@kimmonismus@kimmonismus

    Holy: OpenAI says its first custom inference chip is already beating Nvidia GB200 and GB300 systems on speed and efficiency. Across GPT‑OSS 120B, DeepSeek R1 670B, and Kimi K2.5 1T, Jalapeño delivered 1.5–1.9× more AI work per watt at peak throughput and 1.7–3.6× lower end-to-end latency in OpenAI’s own InferenceX testing! For highly interactive workloads, OpenAI reports 2.1–4.1× higher performance. The chip is rated at 700 watts, but remained at or below 550 watts during the tested workloads. OpenAI plans to begin deploying Jalapeño by the end of 2026. Gen 2 is already deep in development, with Gen 3 taking shape. Probably thats why Tibo said that in 1-2 years 750token/s will be the default

    推荐理由:原文给出 GPT-Astra 用 Codex 生成 kernel 的具体加速数据,读者可据此了解 AI 编写底层算子的表现。

8月24日周一
  1. @alibaba_cloud74

    Kimi-K3 已在阿里云 Model Studio 和 Qwen Cloud 上线,拥有 2.8T 参数和原生 1M token 上下文,面向仓库级软件工程、视觉创作以及能自主规划下一步的智能体。阿里云同步开放 1M token 免费试用,提供 1M-token free trial 与上线即有的 autoTPM 弹性容量。

    推荐理由:阿里云给出 Kimi-K3 的参数量、上下文规格与两个平台的试用入口,可据此判断其可用渠道与定位。

8月23日周日
  1. @kimmonismus71

    据 WSJ 报道,英伟达将投入 60 亿美元打造一个开放权重 AI 模型,通过授权 Poolside 的技术并把其 100 多名员工并入 Nemotron 项目。英伟达还将以 120 亿美元投前估值向 Poolside 追加投资 10 亿美元。其目标是挑战 DeepSeek、Kimi 等中国开放权重模型团队,同时直接对标 OpenAI、Anthropic 等美国前沿实验室。

    推荐理由:报道给出的资金与团队规模,让读者能看清英伟达自研开放权重模型的投入量级及其双线竞争位置。

8月19日周三
8月15日周六
  1. Nathan Lambert: Interconnects71

    Nathan Lambert 解析 GLM-5.3 为何能紧跟前沿

    Z.ai 发布 GLM-5.3,目前仅在 coding plan 提供,两周内将开放权重到 Hugging Face。作者认为其与 GLM-5.2 同底座、靠大幅扩展后训练提升成绩,在部分智能体编码基准上超越 Kimi K3 甚至个别超越 Claude Fable 5 或 GPT-5.6-Sol,参数约 750B。

    推荐理由:作者给出了对 GLM-5.3 成绩来源的解释框架,包括发布节奏、后训练策略和 RL 数据产业等背景,可用于理解中美前沿模型竞争的成因。

7月28日周二
  1. IT Home77

    华为昇腾 0day 适配 Kimi K3,支持训练与推理部署

    月之暗面于 2026 年 7 月 27 日正式开源 Kimi K3,总参数量达 2.8 万亿。华为宣布昇腾实现 0day 极速适配,训练侧基于 MindSpeed MM 在 Atlas 800 A3、Atlas 900 A3 SuperPoD 上完成减层训练基础功能适配。

    推荐理由:原文给出昇腾对 Kimi K3 的训练与推理适配细节,读者可了解国产算力与开源大模型的协同路径。