AI 绘画动漫风格百科第一辑:赛璐璐、厚涂、萌系等 8 种风格
AI 绘画动漫风格百科第一辑收录赛璐璐风格、厚涂动漫风、萌系动漫风、少女漫画风、水彩动漫插画风、少年漫画风、赛博朋克风、青年漫画风、机甲风漫风等风格标签。内容由 AI 生成,归入 AIGC Image & Video 分类。
按公众号阅读文章与观点
AI 绘画动漫风格百科第一辑收录赛璐璐风格、厚涂动漫风、萌系动漫风、少女漫画风、水彩动漫插画风、少年漫画风、赛博朋克风、青年漫画风、机甲风漫风等风格标签。内容由 AI 生成,归入 AIGC Image & Video 分类。
OpenAI 发布 Codex 更新,现已支持在 Windows 电脑上直接执行各类操作。ChatGPT 移动端应用中的 Codex 也已适配 Windows,用户可随时随地启动、查看并操控任务,相关工作会持续在 Windows 电脑上运行。
Codex 发布一批体验更新,最受关注的是支持 Windows 的 Computer Use 以及通过移动端 ChatGPT 远程控制 Windows 上的 Codex,但 Windows 端在 Computer Use 运行期间用户无法同时操作,这点与 Mac 不同。
阶跃星辰开源 Step 3.7 Flash,原生支持视觉理解,MoE 架构 196B 总参数、11B 激活,生成速度标称可达 400 token/s。模型为 Agent 场景优化,默认上下文 256K,支持 low、medium、high 推理强度调节,并兼容 OpenAI 与 Anthropic 两套协议。
ElevenLabs 正式发布音乐生成大模型 Music v2,人声表现、乐器演奏和编曲水平在所有流派全面提升,并支持单曲内流派无缝切换、密集歌词与快嘴说唱,以及选定片段的局部重绘。
Cursor 发布一份开发者报告,显示头部用户与中位数在 AI 代码产出、token 消耗和 PR 合并量上的差距仍在扩大。报告指出 AI 写代码前的 input/output token ratio 大幅上升,缓存与上下文增量理解成为成本关键;手动 diff 验收减少,更多 AI 改动直接进入 commit,单个 PR 新增行数和 1000 行以上大 PR 占比都在上升。
雷峰网上线「AI 顶会中文内容库」,首批开放 ICRA 与 CVPR 两大顶会专区,提供论文摘要中译、会议日程快讯和开源代码速递,并独家精校汉化 Keynote 与学术大牛 PPT。该内容库还配套 GAIR DAO 的原创 IP 专访与已举办 30 期的 GAIR Live 线上圆桌,ACL、NeurIPS 等专区将陆续解锁。
GAIR Live 第 031 期将于 6 月 1 日晚 19:00 开播,聚焦多模态长记忆落地难题。丘脑智能 CEO 张源与香港科技大学博士研究生任玺谕将围绕「看得准、找得到、想得清」三大环节,拆解压缩与保真的根本矛盾、Embedding 与 Caption 方案的工程问题及跨模态检索的信息稀释难题。任玺谕主导提出了多模态长期记忆评测基准 MEMLENS 和 MMLongBench。
鲲鹏昇腾开发者圆桌上,清华、中科大与AIGCode团队反馈国产算力生态正从「能用」走向「好用易用」:中科大团队迁移异构平台周期从数月缩短至一周左右,新算法平均加速40多倍、部分场景接近200倍;AIGCode在昇腾上完成MoE预训练优化,算力利用率达65%。CANN算子覆盖率约8个月内从不足三成升至80%到90%,昇腾超节点架构下Token开销可降低约50%、沙箱百毫秒级启动。
何小鹏在小鹏机器人量产动员大会上定下时间表:2026 年四季度完成量产,2027 年一季度进入国内汽车门店导购场景,二季度进入海外市场。他强调小鹏机器人走全栈自研与跨域融合路线,从芯片、操作系统到关节、手都自研,目标是成为"机器人中的苹果"。该机器人即去年年底发布、被称为"最美"机器人的 IRON。
阶跃星辰发布并开源新一代 Flash 模型 Step 3.7 Flash,总参数 196B+1.8B(ViT)、激活参数 11B,支持本地部署,推理速度最高 400TPS。
金宁汇科技 Spiral AI 团队基于自研 AI for Science 长程智能体平台,将 Erdős 单位距离问题的下界指数从 1.014114 提升至 1.0323,相对效果提升 129%。
SophiaPro 创始人程梦琪复盘近 300 天的 AI 应用创业历程,讲述了从垂直 Agent 到 C 端产品的多次方向调整。团队最早做 ToB 营销数字员工 Karis.im,后来转向浏览器插件 TryClico,最近推出长在 Mac 灵动岛位置的桌面端产品 Invoko.ai。
动态工作流(Dynamic Workflows)发布,延续并发 Subagent 逻辑,启动的 Subagent 可能多达数百个,用于处理非常重、规模很大的任务。
Anthropic 于 5 月 28 日发布 Claude Opus 4.8,称其在 coding、agentic tasks 和专业工作上强于 Opus 4.7 且价格不变,同日宣布 Series H 融资 650 亿美元、投后估值 9650 亿美元。
Anthropic 完成 H 轮融资,筹集 650 亿美元,投后估值达 9650 亿美元,领投方为 Altimeter、Dragoneer、Greenoaks 和 Sequoia,黑石、富达、淡马锡、General Catalyst 等跟投,三星、美光、SK海力士作为芯片供应链战略合作方加入。
推荐理由:这轮融资把年化营收、算力协议和投资方名单一并披露,可看到前沿模型公司的资本与算力绑定关系。
作者实测 Claude Opus 4.8,认为其编码体验比 Opus 4.7 有进步,但在自家写作 Skill 下仍不如 Opus 4.6,出现禁用词和奇怪比喻。
Anthropic 发布 Claude Opus 4.8,同时为 claude.ai 加入努力值控制,并在 Claude Code 中推出研究预览阶段的动态工作流。
推荐理由:Opus 4.8 的诚实度优化和 Claude Code 动态工作流案例,展示了长期任务交给模型时的可控性与用量权衡。
Anthropic 发布旗舰模型 Claude Opus 4.8,官方称是基于 4.7 的常规升级,价格与 4.7 一致(每百万 input token 5 美元、output token 25 美元),当天起全平台可用。
AI寒武纪整理了 OpenAI 官方的 Codex 使用最佳实践,核心观点是把 Codex 当成需要持续配置和改进的队友,而非一次性助手。内容涵盖提示词的目标、上下文、约束条件、完成标志四要素,AGENTS.md 多层级规范文件,/review 代码审查,MCP 连接代码库外的工具,以及把重复工作流封装成 Skill 并交给后台自动化定时执行。
赛博禅心翻译了 Anthropic 的 AI Agent Zero Trust 安全白皮书,讨论 agent 开始自主执行操作、调用工具和跨系统协作时如何落地 Zero Trust 原则。
飞书云文档现已支持Markdown,作者认为Markdown凭借纯文本、结构清晰、token消耗低等特性,已成为人与AI之间信息流转的底层格式。Claude Code的Thariq曾撰文主张AI时代应转向HTML,作者则提出Markdown是数据层、HTML是视图层的分工关系。
AI绘画动漫风格百科第一期收录40类动漫作品风格,用于拆解动漫类AI绘画作品中的风格关键词,解决看到作品只会说“好看”、无法复刻prompt的问题。作者称借此可自行动手创作。
歸藏开源了 guizang-social-card-skill,这是一个从 PPT Skill 中拆出、按 3:4 竖版图文卡片重新校准的 Skill,同时支持 21:9 和 1:1 公众号头图。
文章整理了一套让 Claude Code 自动发现并修复 bug 的配置方法,由 CLAUDE.md 规则、钩子和记忆系统三层组成。文中引用 Claude Code 创始人 Boris Cherny 的采访称,团队已停止人为修复 Claude 的错误,改为让 Claude 自己修复。
Cursor 今年 5 月推出 Agentic 编程模型 Composer 2.5,在 1 万亿参数 MoE 基座 Kimi 2.5 上做深度后训练,同等能力下成本效率可高出 10 倍。
百川智能在清华大学「AI 医疗新范式」论坛上发布新一代医疗大模型 Baichuan-M4 和 AI 家庭医生「百小医」,称 M4 在 HealthBench、HealthBench Hard、HealthBench Professional 三大医疗榜单同时位列第一,事实性幻觉率降至 3.3%。
小米 MiMo V2.5 系列降价 99%,作者把国内一线模型价格放在一起横评:MiMo V2.5 Pro 与 DeepSeek V4 Pro 同价,每百万 token 输出均为 ¥6($0.87)。
数字生命卡兹克发布一篇 Codex 保姆级教程,覆盖安装登录、三档权限、模型与推理等级选择、剩余额度查看,以及用 AGENTS.md 设置全局规则和管理插件、Skills。
锦秋基金通过旗下平台发起无锡明烨股权投资合伙企业,认缴出资额7.71亿元,字节跳动全资子公司北京新异卓越认缴3.7亿元、占比47.989%,为最大出资方。该基金另有百业源投资2亿元、拉萨慧业投资1亿元等LP,锦秋定位"AI Native基金",聚焦算力、具身智能、AI硬件与AI应用。截至发稿,该基金尚未在中基协备案。
作者发布AI人物绘画手册完整版,用Codex的gpt-image-2生成1112张图,整理了发型、发饰、服饰、表情、姿态、镜头角度与布光等上千条中英对照提示词。手册按主题分类,适合在用AI画人物时随手查阅,作者预告第二辑将在近期推出。
极客公园与 Founder Park 组织的 Agent 创业闭门 Meetup 交流了 Make for Agent 的产品做法,核心结论是生意仍面向付费的人而非 Agent 本身。
UniPat 实验室发布 SaaS-Bench,通过检测 Docker 中真实开源 SaaS 的数据库状态变化来评估 Agent 是否真正完成办公任务。该基准打包 23 个开源 SaaS、覆盖六个领域共 106 个任务,93.4% 跨两个以上 App,长程任务多超 100 步。
阿里 Accio Work 推出企业版,支持团队成员共享 Skills 和 Agent。管理员可将 Skill 设为全员可见,成员一键安装使用,Skill 更新后同事在右上角点一键更新即可同步;普通成员推荐的 Agent 需管理员勾选所有人可见后才能被团队使用。团队空间还提供成员管理、权限分级和积分计费,入门版最多 5 人,另有 15 人、50 人版本。
LitGate 团队对 TapTap Maker 的25项核心能力做系统测评,结论是其语言编译层与逻辑系统层达到同类产品平均偏上水准,引擎与表现层问题集中。物理碰撞用例共经历7轮修复尝试,UI 误用会让血条与血量脱节却不触发报错。平台侧凭借 TapTap 分发资源与活跃创作者社区,在游戏发布推广和生态繁荣度上明显领先同类产品。
海外独角兽以访谈和公开数据复盘 Mintlify:它把开发者文档做成 agent 可读取的知识层,2026 年 4 月以 5 亿美元估值完成 4500 万美元 B 轮,Sacra 估算 2025 年 ARR 约 1000 万美元、NRR 约 150%。
作者Draco正在VibeCoding发布AIGC绘画人物设计白皮书第一辑,由GPT-Image-2绘制135张图、合计536个子图。内容按发型、服饰与表情等类别整理中英对照术语,供生图提示词参考,第二辑因图片太多改天发布。作者认为成本是当前图片生成替代HTML的主要瓶颈,走API生成一张高清图约几毛钱,降到几分钱甚至更低量级才可能跨过那条线。
一位AI创业者总结出AI时代招人最看重的6点特质:好奇心、靠谱、有事实洁癖、多元化思维、能忍受不确定性和低ego高自驱。他认为AI时代知识半衰期已缩短到3个月到半年,知识存量不断贬值,持续学习的意愿才是关键,而技能可以用AI补上,特质不行。
作者基于近期使用 GPT-Image-2 的经验提出,应像使用 Agent 一样使用该模型,通过构造 Meta-Prompt 模板把具体人物或事物作为变量,生图时再填入变量即可。模板中{人物小传}、{能力}、{战绩}、{武器}、{色盘}等次级变量会跟随核心变量【人物】变化,从而不必为每张图写上千字的描述。文中给出了动漫海报、双人战斗画面和中国邮政邮票三类模板示例。
Google I/O 2026 发布 Gemini Omni,将多模态能力从输入端扩展到输出端,Agent 成为本次大会最大叙事。Founder Park 在加州山景城举办闭门交流,50 多位创业公司创始人与 AI 研究员围绕 Agent 落地的「最后一公里」、垂直 Agent、Harness 层与 Agent Infra 的创业空间展开讨论。