前华为天才少年李博杰公开吐槽 DeepSeek 面试「最不专业」
前华为首批「天才少年」李博杰在朋友圈公开吐槽 DeepSeek 面试流程,称其是自己「面到最不专业的」,并宣布终止面试流程。他列出三点不满:笔试通过后半个月无人联系、面试官迟到且态度轻佻、代码面试时被质疑「抄代码」并遭威胁终止面试。截至目前 DeepSeek 方面未作回应。
微信公众号
前华为首批「天才少年」李博杰在朋友圈公开吐槽 DeepSeek 面试流程,称其是自己「面到最不专业的」,并宣布终止面试流程。他列出三点不满:笔试通过后半个月无人联系、面试官迟到且态度轻佻、代码面试时被质疑「抄代码」并遭威胁终止面试。截至目前 DeepSeek 方面未作回应。
由 YC 孵化的 Synthetic Sciences 推出开源科研工作台 OpenScience,覆盖文献检索、假设生成、代码实验到论文撰写全流程,且不绑定任何模型厂商,Claude、GPT、DeepSeek、GLM 均可接入。
腾讯混元Hy3正式版发布,总参数295B、激活参数21B,最大支持256K上下文,是快慢思考融合的MoE模型,重点提升Coding和Agent能力。元宝随之迎来大版本升级,在对话中能直接生成可下载的PPT、Word、Excel、PDF甚至HTML页面,这些在快速思考模式下即可完成。
openJiuwen 社区发布多模态 Skill 范式 Skill-Omni,可将网页和 B 站视频中的截图、关键帧与操作脉络自动提取为 Agent 可复用的多模态 Skill。
蚂蚁灵波开源空间原生具身视觉基模 LingBot-Vision,并发布 LingBot-Depth 2.0。LingBot-Vision 约 10 亿参数,纯自监督训练,在 NYU-Depth v2 上取得对比模型中的最佳精度,其 0.3B 学生模型精度与 7B DINOv3 相当,参数量少约 23 倍。
浙江大学 APRIL 实验室与快手主站技术部的研究者提出 MemGUI-Agent,一个面向长程手机 GUI 任务的端到端 Agent,核心设计 ConAct 把上下文管理变成与 UI 点击、输入同级的动作。
Anthropic 发表了一篇研究 Claude 内部机制的论文,称在 Claude 内部存在类似功能分层的结构,其中一小撮神经表征占用运算量不到十分之一,被命名为 J-space。
至简动力7月6日宣布首款全场景机器人i7 Pro完成首批百台交付,用时不到一年,创具身智能行业最快百台交付纪录,同日亮相全球首个CNC智能化具身机器人产线。i7 Pro最高配版本售价22.98万元,已进入CNC、柔性PCB、光模块等场景,下月还将发布两款新品。
蚂蚁阿福6月下载量超400万、环比增长58%,反超Keep登顶AI文娱+生活赛道用户新增榜。其2026年上半年累计下载超3800万,在赛道中断层领先,并进入日活400万以上的第二梯队。快对AI以近1200万DAU断层领先,FacePlay以31.22%的三日留存率居用户粘性榜首。
蔚来向超70万蔚来和乐道车主推送最新版世界模型,一套代码覆盖Banyan、Cedar、Cedar S、Coconut+四个平台,兼容英伟达Orin-X与自研神玑NX9031两种芯片,最早可追溯至2022年3月交付的首批ET7,且未推出蒸馏版。蔚来自研AI编译器将模型部署从1-2周压缩到1-2天,推理效率比通用工具链提升20%以上;神玑NX9031内存带宽达546GB/s。
谷歌成为 Formula E 首席 AI 伙伴,Gemini 为赛事提供实时解说、Driver Agent 数据分析和驾驶模拟器反馈。此前双方还完成一次极限挑战:在电池仅剩 1% 的条件下,Gemini 算出最优刹车能量回收路线,帮助车手跑完摩纳哥赛道一整圈。
推理优化公司 Wafer 公布数据,在 AMD MI355X 上运行 GLM 5.2 实现单节点吞吐 2626 tok/s、单流 213 tok/s,吞吐约为英伟达 B200 的八成,成本不到其一半。
衔远科技大观研究院发布企业 Agent 评测基准 EnterpriseClawBench,从真实企业工作会话中构建 852 个可复现任务,并人工审计出 120 个 Lite 任务子集。
字节Seedance视频模型正在被好莱坞独立电影人和创作者采用,进入电影及长片制作流程。据《洛杉矶时报》报道,95分钟长片《Hell Grind》由15人团队用Seedance 2.0在两周内完成,AI奇幻剧集《骸骨编年史》单集平均观看量达300万。Artificial Analysis数据显示,Seedance生成视频加音频的成本约为每分钟9美元,低于Google Veo的每分钟24美元。
GPT-5.6 Sol 首批内测报告显示,英伟达首席工程师称其用 30 小时跑赢了 Opus 64 小时的 CUDA 加速效果,代码行数仅为 Opus 的 1/5。Sol 每百万输入 Token 5 美元、输出 30 美元,成本约为 Fable 5 的一半,但整体代码质量与体验仍略逊于 Fable 5。模型预计最近两天正式全量上线。
Slash 战略业务负责人 Nicolas Brilliante 用 Vibe Coding 做出一款脑腐射击小游戏,自称一周烧掉 81267 美元 AI Credits,游戏上线 48 小时吸引 6912 名玩家、累计游玩 8986 小时,并带来 3 家品牌主动询问广告合作,公司称其为平台带来 1 亿美元新增 AUM(属自报数据,未提供第三方验证)。
开源工具 pxpipe 把 Fable 5 的文本上下文渲染成 PNG 图片再喂给模型,借图片 token 按像素计价的差异,实测把端到端账单降低了 59% 到 70%。它本质是一个本地代理,拦截 Claude Code 请求,只压缩系统提示词、工具文档和较早历史等又长又密的内容,保留 ID、哈希、密钥和精确数字。作者提醒这是有损压缩,Opus 4.8 在图片化内容的逐字读取和词频统计上容易失误。
上海AI Lab等团队提出ComAct(COM-as-Action)范式,让Agent直接生成COM代码操纵SolidWorks、AutoCAD等专业软件,而非模拟鼠标键盘操作。
Fable 5 二次开服后,网友用一条提示词就能复刻《塞尔达传说 荒野之息》《上古卷轴 5》《Minecraft》等经典游戏,耗时从 20 分钟到一两天不等,初代宝可梦仅用 1 小时推理加 8000 行代码生成 151 只精灵。
影目INMO与WHL联合打造、王嘉尔参与设计并佩戴的AI眼镜Magic AI Glasses首批预定达5万台。沙利文《白皮书》显示,影目INMO以37.8%份额领跑中国AI+AR智能眼镜全渠道累计销量,并与雷鸟、Rokid构成第一梯队。其AIR3和GO3海外双线众筹均突破100万美元,零售网络已覆盖全国44个城市、500家门店。
开源视频制作系统 OpenMontage 在 GitHub 热榜持续霸榜,几天内涨到 15.4k stars,一度冲到 Top 1。它内置 52 个工具模块、12 条标准化视频流水线和 400+ 可组合技能,用户对 Claude Code、Cursor、GitHub Copilot 等编程工具说出需求,就能自动完成脚本、素材、配音、字幕到剪辑。
上海交大、马来亚大学、CMU、MBZUAI、KIT 和 KAUST 团队提出 VisNec(视觉必要性分数),通过对比看图与不看图两次前向的损失差衡量每条样本的视觉价值,被 ECCV 2026 收录。
百曜科技发布全球首个基于 LLM-JEPA 架构的 AI 虚拟细胞世界模型 AURA CellOS,基于 3.905 亿个人类单细胞转录组训练,覆盖 40 余种人体组织、260 余种细胞类型,为目前公开报道中参数规模最大的单细胞基础模型。
工程师 Abdur Rahim 把 DeepSeek 在 6 月 27 日开源的 DSpark 移植到苹果芯片,做出 Mac 原生版本 mlx-dspark,支持 Gemma-4 12B 和 Qwen3-4B,输出与原模型逐字节相同。
英伟达 GEAR 联合李飞飞团队、佐治亚理工大学等机构发布 Real2Sim 系统 SimFoundry,只需一段真实世界视频即可自动生成可交互、可训练、可评测的机器人仿真环境。
阿里达摩院联合人大、国科大等机构发布超导材料发现智能体 ElementsClaw,用 28 个 GPU 小时扫描 240 万种稳定晶体,预测出 6.8 万种潜在超导体。团队选取部分材料合成验证,发现 4 种人类此前未知的新超导体,最高临界温度 6.5K,推荐命中率约 40%。240 万种晶体的超导预测数据库已对外开放,供研究人员使用。
GitHub 上开源了一套 Loop Engineering 框架,提供七套现成工作流和10个启动模板,已累计获得4.5k Star。用户可用 npx @cobusgreyling/loop-init 选择 daily-triage 等模式启动,适配 Claude Code、Codex、Grok 和 OpenCode。
华大智造子公司涌生智能与上海人工智能实验室联合发布多智能体系统 ProtoPilot 和评测基准 BioLab Bench,覆盖从自然语言实验意图到湿实验设备执行的完整链路。
上海交通大学李永露RHOS团队联合上海创智学院、中国科学技术大学和Math Magic提出HAT-4D,仅输入一段单目视频即可由多Agent协作完成多物体4D交互重建,论文已被ECCV 2026接收。
纽约大学联合 LeCun 初创 AMI 提出 JEPA 系列新成果 AdaJEPA,让世界模型在部署中通过测试时自适应实时更新编码器和预测器参数,实现持续学习。在 PushObj 未见过形状上规划成功率几乎翻倍,PointMaze 未见布局中 GD 从 53.3% 提升至 78.7%、CEM 从 49.3% 提升至 70.7%,额外延迟仅 0.01 到 0.03 秒。
Claude Fable 5 回归后不久便收到大量用户吐槽,问题集中在安全机制频繁误拦问题、请求被暗中降级到 Opus 4.8,以及跑分明显下滑。评测机构 BridgeMind 用 BridgeBench 测得三项核心指标全线下跌,12 个 debugging 任务中只有 3 个未触发降级跑完,其余 9 个被判定不安全转交 Opus 4.8 并记为零分。
地瓜机器人发布世界模型 Uranus,定位机器人开发基础设施,用帧级闭环生成视频充当 VLA 与世界模型的评测基准和 manipulation 仿真器。它训练时只见过 2 秒片段,推理时可稳定运行 60 秒,支持 G1 人形机器人和 Franka 协作臂的跨具身零样本泛化,目前仅支持 manipulation 训练。团队计划今年下半年把数据从几百小时扩到几千小时量级。
量子位将全程驻守7月13-17日在澳大利亚悉尼举办的RSS'26现场,打造具身智能内容专题,覆盖技术突破、产业落地与生态共建。7月14日晚,量子位联合源策未来、OpenDriveLab 策划 RSS'26 Social Mixer 线下聚会,会后还将推出 After Hours 线下学术交流。论文入选者及现场合作方可联系 chenfei@qbitai.com 寻求报道。
美团发布LongCat-2.0,采用自研MoE架构,总参数1.6万亿,每token激活约48B参数,原生支持1M上下文,从训练到推理全程基于国产芯片,官方称其为首个在国产算力上实现全链路训推闭环的万亿参数模型。
人大高瓴人工智能学院提出 token credit assignment 算法 DelTA,通过求解优化问题为强化学习目标中的每个 token 计算最优权重,而非依赖经验手动分配。
量子位将全程驻守7月13-17日在澳大利亚悉尼举办的RSS'26(Robotics: Science and Systems)现场,打造具身智能内容专题,产出技术风向深度解读稿件并拍摄现场视频。
Claude Fable 5 在消失19天后重新全球上线,Claude.ai、Claude Code、Cowork 均已可用,但订阅用户每周最多使用50%额度,且仅开放7天窗口(太平洋时间7月1日至7月7日),此后转为按 usage credits 计费。
UC伯克利 EECS 系主任 Jelani Nelson 宣布暂离教职,加盟 Anthropic 预训练团队,该团队聚焦 Claude 核心知识与能力研究。Nelson 以哈佛 Advanced Algorithms 公开课闻名,播放量超 2100 万,此前自 2021 年起在谷歌兼职担任研究科学家。
FaceMind 脸谱心智提出 Ego-NeuroLoop 数据范式,同步采集 world camera、gaze、EEG、sEMG 四类信号,记录人类操作时"预测、执行、反馈、修正"的完整闭环。
乐奇Rokid 在 Rokid Open Day 2026 上首次提出具备主动管理意图能力的 AIOS 原生智能眼镜操作系统,并配套发布跳出传统 GUI 逻辑的交互标准 AIUI(AI Generated UI)。YodaOS 成为该 AIOS 的落地底座,其智能体商店已上架超 440 个智能体,另有 5000 多个在研发迭代中,开发者社区汇聚数万名注册与认证开发者。