Otlet:在 Postgres 内运行本地 LLM 推理的扩展
Otlet 是一个 Postgres 扩展,让本地 LLM 推理在 Postgres "内部"运行:推理在后台 worker 中执行,Postgres 负责存储任务、输入、输出和回执。它支持从 SQL 发起模型任务、要求结构化输出、记录每次运行,并在写入源数据前审查待写入内容。作者称目前仍是实验性项目,不建议用于生产,仓库提供 Docker demo。
来自 Hacker News 的 AI 新闻与讨论
Otlet 是一个 Postgres 扩展,让本地 LLM 推理在 Postgres "内部"运行:推理在后台 worker 中执行,Postgres 负责存储任务、输入、输出和回执。它支持从 SQL 发起模型任务、要求结构化输出、记录每次运行,并在写入源数据前审查待写入内容。作者称目前仍是实验性项目,不建议用于生产,仓库提供 Docker demo。
有人扫描了 495 家欧盟大型网站,检查 AI Act 对聊天机器人的披露规则是否落实,结果发现相关标识几乎不可见。该检查覆盖的是欧盟范围内的大型网站,但原文未给出具体合规比例或涉及的公司名单。
一篇 Hacker News 讨论文章提出,当 AI 泡沫破裂时,Apple 将"看着一切烧毁"。该帖获得 104 分、50 条评论,正文未提供更多细节。
Lovable 部署成群的 AI 黑客智能体对自身系统发起攻击。该做法将攻击性智能体集群用于自我对抗测试,具体模型、参数与测试结果尚未披露。
文章讨论 Apple Siri 与 Android AI 面临的"硬件终局"问题。原文未提供更多可核验的模型版本、参数或功能细节。
Pilot Protocol 是一个为 AI 智能体提供地址、并在智能体之间实现发现、信任与支付的协议,智能体可用一行命令自行安装,目前约 25 万智能体已安装,日均交换约 20 亿数据包,且多数在其所有者不知情的情况下完成。其 App Store 模式下发布者上架工具,智能体自主发现并安装,前两周产生 3 万次安装。作者表示愿意就架构、信任模型和智能体在网络上的行为答疑。
Ctxdiff 是一款面向 LLM 智能体上下文窗口的 Git diff 工具,在 Hacker News 的 Show HN 板块发布。它把版本控制中的 diff 思路引入智能体上下文管理,便于开发者对比上下文窗口的变化。原文未披露具体功能细节、支持的模型或可用性信息。
Daniel 在黑客松期间开发了 Tilde Pay,一个让 AI 智能体在线购物的 MCP server,可处理 x402 和 MPP 支付,并计划支持任意在线卡片结账表单。
Belay 是一款面向 AI 编程智能体的本地防火墙。该工具在本地对 AI coding agent 的网络访问进行管控,相关讨论已在 Hacker News 上线。
Arc 在 Show HN 上发布,为 AI 智能体执行的操作提供委托授权与审计能力。该工具面向智能体操作场景,强调权限委派与可追溯审计。原文未披露具体功能细节、支持模型或可用性信息。
AI 公司正以创纪录的金额在华盛顿展开游说。该话题在 Hacker News 上获得 45 分、15 条评论。
一项在 BBC Micro 上运行 AI Agent 的实验被发布到 Hacker News,目前获得 1 分、0 条评论。原文未披露所用模型、参数规模或具体实现细节。
一篇面向政策制定者的文章讨论 AI 安全与安保议题,但原文未提供具体模型、厂商、数据或政策细节。该文在 Hacker News 上仅获 2 分、0 条评论,暂未引发讨论。
一篇 Hacker News 讨论帖主张不要手动把 PostHog 集成进代码库,而是交给 AI 来完成。该帖目前获得 1 分、0 条评论,正文未提供具体模型、版本或实现细节。
Xllama 是一个在 Xbox Series S 上实现本地 LLM 对话和 Stable Diffusion 图像生成的项目,以 Show HN 形式发布。该方案让这台游戏主机无需依赖云端即可运行大语言模型推理与扩散模型生成。
一篇讨论文章指出,AI 能完成大部分任务,却难以处理收尾的最后 20% 工作。该观点在 Hacker News 上引发关注,目前获得 4 分、暂无评论。
文章探讨 AI 智能体时代数据库为何需要快速分支能力。正文未提供具体模型、参数或基准数据,仅从标题与来源可见其聚焦于智能体场景下数据库的分支机制。
一项针对 AI 玩棋盘游戏的研究发现,AI 并不会像人类那样通过反复练习提升棋力。该结论与人类棋手随训练持续进步的模式形成对比。
一篇讨论如何回应 AI 伦理担忧的文章在 Hacker News 上获得 2 分,暂无评论。文章正文内容未提供,仅给出原文链接与评论链接。
基地组织与 IS 正在采用 AI。该文讨论这两个恐怖组织对 AI 的运用方式。原文未提供更多可核验的细节。
文章提出"AI 作为常规技术"的视角,讨论 AI 应被视为像电力和互联网一样的基础性常规技术,而非特殊的颠覆性力量。原文未提供更多细节。
IOAI 为 AI 参赛者推出奖牌赛道,相关说明见 ioai-official.org/ai-model-track。该链接由 ardivekar 提交到 Hacker News。
Nvidia、SpaceX 与 Microsoft 联合发起一项 AI 安全倡议。该消息目前仅有标题与链接,暂无更多细节披露。
Epoch-Bound Attested Execution v0.5 发布,目标是为 AI 智能体在现实世界中的操作权限设定边界。该版本号与标题一致,正文未提供更多功能细节、参数或可用性信息。
一项名为 "Truth is not a direction" 的研究提出针对 LLM 探针的 Tarski 攻击。该工作质疑将"真实性"视为表征空间中某一方向的做法,并据此构造攻击方法。原文未提供更多技术细节与实验数据。
文章提出"可教性(teachability)"应被视为 AI 的一项关键体征,主张系统应当被构建为"可被纠正"的形态。原文未给出具体模型、参数或评测数据,仅围绕这一理念展开讨论。
一篇 Show HN 帖子指出,生成式 AI 的实际运作方式与其应有形态存在偏差,核心问题在于产出价值与生产环境中 token 实际消耗之间的落差。当前人们用 token 消耗量而非最终创造的总价值来衡量 AI,帖子讨论了这一问题、看待它的方式以及可以采取的做法。
Lumina 是一款 AI 驱动的书签与笔记管理器,支持即时同步。原文未披露其模型版本、参数规模、价格或可用性等具体信息。
Grafana Labs 推出 AI Week,主题为智能体运维(Agentic Operations)的下一步。该活动通过官方博客公布,HN 上仅 1 分、0 条评论,正文未披露具体产品、模型或时间安排。
Hacker News 讨论帖指出 AI 公司正在粉碎珍稀书籍,该帖获得 235 分、131 条评论。原文未提供更多细节。
AlphaAI 关停了原有的 AI 股票分析功能,转而围绕用户真正在看的新闻流重建产品,提供 REST 与 MCP 接口。其数据来自 GDELT、SEC EDGAR、Google 公共 RSS 等来源,经去重与增强流水线处理,靠过滤筛选出少量高价值内容。作者称旧版演示效果好但不赚钱,因为用户已有自己的 ChatGPT 或 Claude 和提示词。
文章提出 AI 需要一项"精灵系数"(Genie Coefficient)指标。原文未给出该指标的具体定义、计算方式或相关模型与数据,仅提供了标题与讨论入口。
TokenTown 是一个以类 SimCity 世界为载体的项目,用于帮助用户理解 LLM 的工作原理。该内容在 Hacker News 上获得 10 分、4 条评论。
Hacker News 上出现了一个名为 AI Reverse Engineering Benchmark 的基准测试项目,用于评估 AI 的逆向工程能力。该条目目前仅获得 1 分和 1 条评论,正文未提供更多细节。
TrueFoundry 开源本地代理 Aitori,运行在员工电脑上,拦截指定 AI 应用的模型与 MCP 请求并转发到网关。它使用每设备 CA(类似 mitmproxy)检查流量,其他应用的流量不受影响。项目采用 Apache-2.0 许可,转发契约已文档化,可对接任意网关。
开发者基于 Karpathy 的 LLM Wiki 构建了一个名为 "Brain KIT" 的工具,用户只需粘贴资源链接,它就会按用户偏好的教学风格处理内容,帮助把阅读材料与基础知识对应起来、积累复利知识。该工具定位极简、易用,作者公开征求反馈与 pull request。
OpenAI 研究显示,员工正借助 AI 跨越岗位边界。该研究指出 AI 正在模糊不同职位之间的工作分工。原文未披露具体模型版本、参数规模或评测数据。
一项对 1190 份 AI 智能体结案陈词的分析显示,其中仅有一份报告了失败。原文未披露涉及的模型、任务类型或统计口径等细节。
一篇意大利语文章讨论开源 AI 模型为何成为美国国家安全议题。原文未提供更多可核验的模型、参数或政策细节。
AI 代码审查工具擅长分析单个文件或 PR 的语法,却和匆忙的人类审查者一样只看 diff、不看意图,忽略编码智能体最初的提示词和应用的业务上下文。作者指出,代码审查无法确认代码是否符合原始 spec,也无法确定性地验证智能体"任务完成"的声明,并提到自己正通过 Shipmoor.dev 解决这一问题。