DeepSeek-V4-Flash 正式版发布:能力接近 Opus4.8,成本仅约 1%
DeepSeek-V4-Flash 正式版发布,能力接近 Opus4.8,成本约为其 1%,发布后十几个小时内已有中外开发者将其接入各类 Agent 并展示 demo。同日智谱 GLM 开放订阅并涨价,被指遭到精准狙击;作者同时期待 DeepSeek-V4-Pro 正式版与 DeepSeek 的 Coding Agent。
微信公众号
DeepSeek-V4-Flash 正式版发布,能力接近 Opus4.8,成本约为其 1%,发布后十几个小时内已有中外开发者将其接入各类 Agent 并展示 demo。同日智谱 GLM 开放订阅并涨价,被指遭到精准狙击;作者同时期待 DeepSeek-V4-Pro 正式版与 DeepSeek 的 Coding Agent。
DeepSeek-V4-Flash 正式版(0731)发布,基准测试超过 V4-Pro-Preview、击败 GLM5.2,并紧咬 Opus4.8。作者给出的成本对比显示,V4-Flash-0731 正式版成本约为 Opus4.8 的 1%。作者还提到 DeepSeek-V4-Pro 正式版也即将发布。
GPT-5.6 Luna 降至 2 折,输入每百万 token $0.1、输出 $0.6,GPT-5.6 Terra 打 8 折;MiniMax 发布 H3 多模态模型,可原生理解文字、图片、视频、音频输入,并生成文本、图片、视频。
AI Agent 时代做好自媒体需满足"三加一"要求:输入(Input)、处理(Processing)、输出(Output)构成的 I.P.O. 闭环,加上表达欲。作者主张 I.P.O. 在 AI Agent 时代应一体化,通过"干中学"在真实项目中反复实践,并借助 Agent 用文字、表格、网页、绘画、视频等多模态方式拆解行业专有名词。
作者将 Coding 主力换成 KIMI K3 + KIMI Code(¥699 档套餐),并称 KIMI K3 可能是 2026 年截止目前最重要的一次发布,让他能放心把任何任务交给国产模型。
诗书空间小程序本周更新,小学1-3年级古诗词音频讲解已全部上线,4年级及以上仍在持续更新。每首诗讲解含朗读、释义、诗人故事与奇妙知识四部分,朗读使用 seed-audio 以通过 prompt 控制效果。同时新增搜索功能,并开始为诗词添加 Entity Tag,点击可进入 Entity Pages 查看相关诗词及讲解音频。
阿里千问发布 2.4 万亿参数的 Qwen3.8-Max-Preview,Qoder 同步 Day0 上线,默认按 0.05xCredit 计费,错峰时段为 0.01xCredit。
在 WorkBuddy 的“技能”tab 安装“微信读书助手”skill,配置 API KEY 后即可让它读取个人微信读书记录并生成专题网站,再部署到 EdgeOne Pages。中途可用 KIMI K3 重新生成一版,满意后配置自定义域名。
KIMI K3 发布,Web 与 Desktop 端已上线 K3 Max、K3 集群·Max 和百万上下文,作者实测其在编码与 Agent 任务上与 Fable5、GPT-5.6 Sol 有来有回。
开发者正在 build 桌面应用「诗书时空」,时空书库收录汗青堂、好望角历史丛书及豆瓣评分,可按评分筛选并将书籍按地理位置插旗到 3D 地球仪。山河诗境按省级行政单位整理几百首诗词,并收录人教版、北师大版、苏教版中小学教材全部古诗词及东坡行迹。本地书库支持上传电子书,需自备 DeepSeek API KEY,可将书中地理位置 pinpoint 到 3D 地球仪,项目不再开源。
ChatGPT Codex/Work 产品负责人 Tibo 宣布取消 Codex 的 5 小时限额,作者早晨确认只剩周限额,5 小时限额已消失。Tibo 还在 2 小时前宣布手动重置功能可在 Web 端和移动端使用。作者称自己跑了两天 GPT-5.6 和 Grok4.5,分享第一手体感。
作者连续两天实测同天发布的 GPT-5.6 与 Grok 4.5,给出第一手体感。GPT-5.6 Sol 能力很强但慢且极费 token,一小时内能烧干 5 小时额度;Grok 4.5 则以 Opus 4.8 不到 1/4 的成本和数倍速度提供接近的能力,两天仅用掉 39% 额度。
作者汇总了近期撰写的国内 Coding Agent 相关教程,涵盖服务器、域名等 AI Agent 基建,以及 WorkBuddy 的网站部署、自定义大模型、GitHub CLI 代码管理和保单解读报销等实战内容。其中 QoderWork 教程提到新用户可免费用 1 个月 Pro 版,支持 GLM-5.2 和 KIMI-K2.7-Code。
WorkBuddy 基础教程演示了如何将前端项目部署到自己的服务器:在项目文件夹中放入含 IP、用户名、OS 和 PEM 密钥的 server_info.md,再用 WorkBuddy 打开项目并让它用 three.js 编写太阳系页面并部署到该服务器。
一位在北京生活 20 年的家长在离开北京前,分享了为小学生选择海南创新学校的思考:AI Agent 时代教育应放弃"知识型"灌输,转而呵护好奇心、探索欲和解决问题的信心。他为孩子搭建了基于飞书的 Hermes Agent,用于 AI 绘画与 AI 编程探索,并配置了专属域名上线项目。他认为审美品位是 AI+Robot 覆盖一二产业后最关键的能力,品味即注意力即价值。
马斯克预告 Grok4.5 将于明天发布,与 GPT5.6 同期亮相抢风头。原文未披露 Grok4.5 的参数量、benchmark 分数或可用性等具体信息。
GPT-5.6 全家桶官宣本周四上线。原文未披露具体模型版本、参数规模或可用性细节,仅提到作者手握 Codex 的 4 次重置权。
腾讯云轻量应用服务器 Lighthouse 新手教程,以 Ubuntu 24.04 LTS 为例演示选购与部署流程,建议选择曼谷、新加坡、首尔、东京等海外节点以加快 GitHub 仓库和 Docker Hub 镜像下载。
混元Hy3正式版已上线WorkBuddy,用户可在WorkBuddy模型选择窗口中选择Hy3使用,目前限时免费。
这篇 WorkBuddy 基础教程演示如何将 three.js 太阳系网页通过 tcb hosting deploy 部署到腾讯云 CloudBase 静态托管,并绑定自定义二级域名。
用户通过 WorkBuddy 连接腾讯 Agent Mail,让 AI Agent 读取邮箱中的保单 PDF 并逐条分析报销条件、风险与流程。操作中需用 GLM-5.2 完成配置,因沙箱权限限制可能需多次浏览器授权。材料齐全时保险公司通常 3-5 个工作日完成报销。
阿里推出 QoderWork,新用户注册可免费使用 1 个月 Pro 版。中文处理用 DeepSeek-V4-Flash 即可,耗费仅 0.1X;复杂 coding 可选用 GLM-5.2 或 KIMI-K2.7-Code。
WorkBuddy 支持通过"配置自定义模型"添加第三方大模型,供应商在预置列表中时填入 API KEY 即可保存使用。但预置模型存在版本滞后问题,如 KIMI Coding Plan 只到 K2.6、GLM 只到 GLM5,需手动修改 ~/.workbuddy/models.json 中的 id 和 name 才能用上 Kimi K2.7 Code 等最新模型。
WorkBuddy 教程演示如何让 AI Agent 安装 GitHub CLI(当前版本 2.83.0)并完成 `gh auth login` 登录,从而在 Agent 内直接管理仓库、Issue、PR 与 Actions。
这是 Workbuddy 基础教程第一篇,讲如何用 Workbuddy 把静态网站部署到腾讯 EdgeOne Pages 并绑定自有域名。文中指出 Workbuddy 默认会把不同项目的网页都部署到 EdgeOne Pages 的默认项目里,解决办法是让它安装 edgeone cli 登录后新建项目,或通过导入 Git 仓库创建项目再部署,部署一般 1 分钟内完成。
面向 AI Agent 建站场景的域名注册教程,以腾讯云为例演示购买流程,并提示域名下的【轻量应用服务器】【DNS解析】【SSL证书】均无需勾选。域名可用于 Workbuddy 的 EdgeOne Pages、Vercel、GitHub Pages、Cloudflare Pages 等平台的自定义域名映射,购买后主要与 DNS 打交道,后续网站项目都需通过 DNS 映射到自有域名。
Claude Sonnet 5 凌晨发布,百万 token 输入输出费用分别为 2 美元和 10 美元。作者指出这一价格约为 GLM-5.2 和 KIMI-K2.7-Code 的 3 倍,并称其为 A 社性价比最高的模型。
作者宣布从明天起将写作重心转向国内 Agent,围绕 Workbuddy(Codebuddy)、Trae、Qoder、KIMI Work 等制作系列教程,改为每篇聚焦一个小专题的短平快形式。
开发者开源了一个用 MapLibre GL JS 构建中国地理历史应用的项目仓库,通过自烘焙 DEM relief 地形底图叠加 Terrarium DEM 高程数据,将书籍事件、章节路径和地点 pinpoint 映射为交互式可视化。
企业微信 5.0.9 版本开启原生 Agent「大圆」内测,提供三个可选模型,其中 DeepSeek-V4-Flash 主打文本处理,也能识别图片。大圆把聊天记录、企微文档、智能表格都当作上下文,可自动生成客户服务总结与跟进列表,并支持配置触发条件和 Prompt 模板。与飞书、钉钉不同,大圆始终站在人的背后,针对人与人之间的沟通做提效赋能。
Hermes 上线 MoA(Mixture of Agents)混合模型模式,用户可在 config.yaml 中配置已授权的模型,将最强模型设为 Aggregator 判官、最多 8 个模型作为 Reference,并通过 /moa 命令切换。该模式以更多 token 消耗和更长耗时为代价换取输出质量,作者称仍在用复杂游戏项目测试,尚未得出明确结论。
腾讯正在内测面向 AI Agent 的专用邮箱 agent.qq.com,作者注册邮箱后通过 Agent Mail CLI 完成接入,让 Agent 收发邮件。内测期每天发信上限 50 封、容量 1GB,该域名邮件会自动进入垃圾邮件需手动移出。作者还列出任务收件箱、外部协作入口、自动周报聚合、资料投递到知识库等使用场景。
Hermes 上线 /learn 模式,可向它输入 GitHub 仓库、PDF、API 文档、配置文件等资料,由其自行学习、提炼并封装成合适的 Skill。在 hermes agent 终端输入 hermes update 即可完成升级。
Seed-2.1-Pro 在 DracoBench 上得分 94 分,排在 GLM-5.2、KIMI-K2.7-Code、KIMI K2.6 和 GLM-5.1 之后。
作者用 Codex 搭配 Hyperframes、Open Design、MiniMax CLI 和火山引擎 doubao-TTS-2.0 搭建出 NoteBookLM 平替,可在几分钟内针对知识点生成视频化解读。
Cloudflare 于 6 月 19 日上线 Temporary Accounts,Agent 写出的网站项目无需任何登录授权即可直接部署到 Cloudflare 并公网可见,部署环境默认保留 60 分钟,期间可随时申领持久化,否则自动释放。
GLM-5.2 在 Design Arena 的单轮 HTML 网页设计(Non-Agentic)评测中总分第一,比上一代 GLM-5.1 高 5 个名次,击败长期霸榜的 Claude Fable 5、Opus 4.6 和 Opus 4.7,成为首款登顶的开源模型,MIT 授权。
一篇端午节祝福内容给出了 GPT-Image-2 的提示词示例:比例 3:4,主体为像素化端午节庆典海报,日期 2026.06.19,色盘以绿色为基调、莫兰迪色调并配少许撞色。作者同时标注内容由 AI 生成。
月之暗面 Kimi Work 更新至 V3.0.21,token 消耗减半即额度翻倍(活动疑似持续到 6 月 30 日),并新增官方称可连跑 24 小时的 Goal 目标模式,以及最多支持 300 个 sub-agents 同时工作的 Agent 集群模式。
作者分享了一个 GPT-Image-2 的炉石传说卡牌系列提示词模板,只需替换 {人物} 即可复用。模板设定比例为 9:16、主题为 {人物} 的炉石传说卡牌,风格为半写实日漫加水彩厚涂,示例人物为 ONE PIECE 中的娜美。文中还列出海贼王 Girls 扑克牌、《灵笼》白月魁、用 emoji 控制人物表情、王者荣耀海报等同类系列,并注明内容由 AI 生成。