顶尖数学家:LLM 是强大的计算器,却是糟糕的创造性思考者
数学家 Timothy Gowers 和 Peter Sarnak 认为,大语言模型擅长组合已知方法,但缺乏产生真正全新数学思想的直觉。
the-decoder.com · 网站与博客
数学家 Timothy Gowers 和 Peter Sarnak 认为,大语言模型擅长组合已知方法,但缺乏产生真正全新数学思想的直觉。
一项有 Google 研究者参与的研究发现,训练聊天机器人不宣称自己有意识,会连带改变它们在动物权利、宗教和生活满意度上的立场。被解除限制的模型会赋予动物显著更多的内在生命,并突然肯定来世的存在。研究显示,对模型的一处"手术式"修改并不会只停留在局部。
OpenAI 关闭了负责评估自家 AI 模型是否可能带来灾难性风险的 Preparedness 团队,相关工作被拆分给现有团队,数名安全员工已经离职。内部不安情绪正在累积,一位消息人士形容这是一种“隐隐的责任感与恐惧”,认为 OpenAI 在安全上做得不够。
Anthropic 在一份安全报告中披露,其针对生物和化学武器风险的内部过滤系统停摆近一年。期间约 5 万名外部反馈承包商与模型进行了约 1.33 亿次未经过滤的交互。
Artificial Analysis 推出 Optima 平台,用户可基于自己的数据和工作流构建自定义 AI 基准测试。模型对比不只看质量,还看每个任务的成本与耗时。对于基于智能体的应用,这些指标往往比单纯的 token 定价更能说明问题。
Epoch AI 的一项代表性调查发现,20% 的美国在职者至少把一项原本由人完成的任务交给 AI 处理。这些人在多数情况下很少修改甚至完全不修改就接受 AI 的输出。
在投资者对风险提出异议后,Nvidia 将给 OpenAI 俄亥俄数据中心的担保从 2500 亿美元削减至略低于 1200 亿美元。与此同时,Anthropic 单季营收从 47 亿美元跃升至 115 亿美元,为 AI 泡沫争论增添了新的对照。
一项新研究显示,AI 生成书籍已占亚马逊自出版目录的 20%,但只带来 12% 的销量。人类写作的书籍在八个类型中有七个的单书收入出现下降。研究结果可能为针对 AI 公司的版权诉讼提供此前缺失的市场损害数据。
美国康涅狄格州一名原告在法庭文件中嵌入不可见的提示词注入,用 3-point 白色字体写在白色背景上,试图操纵可能存在的AI审查系统。法官 Spader 将此举类比为秘密篡改陪审团,撤销了原告的电子提交权限。法院强调康涅狄格州并不使用AI审查文件,但仅凭这一意图就足以实施制裁。
李飞飞创立的 World Labs 发布一款仿真引擎,可完全在虚拟环境中训练机器人控制器,从单个真实任务生成数千种受控变体。训练出的模型随后在五种不同机器人平台上各自主运行一小时,无需人工干预。其在更复杂日常场景中的表现仍待验证。
一篇新研究论文将 AI 采用称为"认知公地悲剧":每家企业裁减入门级岗位都能单独获益,但整个职业的集体专业能力会随之侵蚀。其后果可能要到 2030 至 2045 年才会显现,届时今天缺失的初级人才本应成长为明天的资深从业者。