OIL®github.com/oil-oil
文章 / Articles
2026.09.03放弃手写界面后,我用 Codex 搭配飞书 CLI 搭建了创作工作台我把原本用 DeepSeek Harness 搭建的自媒体创作工作台,改成 Codex 搭配飞书 CLI;这套方案用项目级 Skill 管理多维表格,也把工作台延伸成跨 Agent、跨端共享的云端知识库。
2026.09.02两天做出 7 万访客的 VibeHub:外滩黑客松三等奖与我的参赛反思我用两天做了一个面向 Vibe Coding 用户的术语网站 VibeHub,先经过设计师群内测和修改,再发布到社交媒体,最终拿到了外滩黑客松三等奖和小红书人气奖。
2026.09.01用 Semrush 挖掘长尾词,让 AI 结合源码批量优化 VibeHub 的页面 SEO我用 Google Search Console 看清 VibeHub 目前主要依赖品牌词,再用 Semrush 找低难度长尾词,让 AI 结合源码和自动化浏览器批量优化页面。
2026.08.31试了一圈模型后,我为什么把文案工作交给了便宜的 Gemini 3.7 Flash?GPT、Grok 和 Kimi 适合编程与设计,但文案里仍然容易有 AI 味。文章对比了 GPT 5.6 Luna 与 Gemini 3.7 Flash 在使用和不使用 oil-tone 规范时的表现,并记录了把 Gemini 接入文案修改工作流的方式。
2026.08.30我用 Codex 的 Section 分组与内置 Agent 批量整理 700 个历史话题Codex 现在支持在产品层面创建 Section,把项目和话题按业务分类,不再强制绑定本地文件夹。内置 Agent 还可以批量归档长期未使用的任务,或创建 Section 并移动指定项目。
2026.08.29我用简短提示词实测了 5 个模型的前端网页设计能力我用相同的简短提示词,让 Gemini 3.1 Pro、GLM 5.3 Flash、GLM 5.3、Grok 4.6 和 Kimi K3 在 5 个网页场景中单轮生成,再比较它们的设计效果、交互创造力和实际开发适用方式。
2026.08.28做出的 App 只有 7 个播放,平庸但能解决问题的产品该怎么做社媒?一位没有互联网公司背景的开发者,用 Vibe Coding 独立做出了 iOS 应用「报销助手」,但露脸介绍产品的视频只有 7 个播放。我从这次咨询出发,聊聊平庸但能解决问题的产品该怎样挖掘内容。
2026.08.27我在 Codex 中深度使用 GPT 5.6 Sol 遇到的额度瓶颈与过度防御我在实际使用 GPT 5.6 Sol 与 Codex 的过程中,越来越明显地感受到用量、文档、测试和上下文处理上的限制。结合 Grok 的使用体验,聊聊我现在对不同模型的取舍。
2026.08.26我在 DeepSeek Harness 里常驻的 6 个单点插件与自研 Skill我在 DeepSeek Harness 里实际使用了几个插件,分别解决桌面端运行、主题样式、长对话定位、侧边栏、余额查看和内容管理等具体问题。这篇文章也分享我如何寻找和开发 DeepSeek Harness 插件。
2026.08.24让 AI 快速定位网页元素:我把开源选择器升级成了浏览器拓展 Selector ProSelector Pro 是一个浏览器拓展,可以把网页元素的代码位置、页面上下文和视觉信息一起交给 Codex。文章记录了它的快捷键、多选、文本与 Markdown 提取,以及写轮眼模式。
2026.08.23像做产品一样做 Agent Skill:从本地能跑通到别人用得顺手我把 Skill 当成运行在 Agent 上的软件,从 onboarding、脚本分工、弱模型兼容、中间产物、可视化交互、跨平台测试和无上下文对比几个方面整理产品化方法。核心不是让它只在本地跑通,而是让别人也能稳定使用。
2026.08.23实测 9 个场景后,便宜 5 倍的 Grok Image 2 为什么还替不掉 GPT?我用同一套提示词对 Grok Image 2 和 GPT Image 2 做了 9 类生图对比,观察封面、概念图、UI、绿幕、写实场景和连续派生等结果。结论是 Grok 更适合无字官网配图和写实场景,严肃封面、精准文字和透明底任务仍不能依赖。
2026.08.22避开棋盘格假透明:我在 Codex 中稳定获取透明底图片的三种方案Codex 内置 `/image` 目前无法稳定生成透明底图片,我把一次测试中的棋盘格假透明、模型和参数限制,以及三种可行方案整理成了一篇文章。方案包括 QuickChat 拖拽、外部 API 显式传参,以及绿幕配合自动抠图脚本。
2026.08.21用 MiniMax MCODE 终端版做交互网页,第一方 Agent 的优势在哪里?我用 MiniMax 的 M3、H3 模型、oil-motion Skill 和 MCODE TUI 做了一个随滚动执行动作的网页动效,并整理了对 TUI、Agent Team、Matrix 和 ACP 的实际使用感受。
2026.08.20VibeHub 上线一个月突破 5 万访客:自然流量留存与「路线」功能迭代VibeHub 上线一个月访客超过 5 万,我记录自然流量的留存情况,以及路线、练习、收藏和防 AI 味等新功能。
2026.08.20我把自己的视频创作工作台做成了 DeepSeek Harness 开源插件我把自己用来管理视频封面、脚本、字幕和文章的 DeepSeek Harness 工作台插件 dsh-oil-creator 开源了。这篇文章记录安装、配置、使用方式,以及 Screen Studio、Ego Browser 和外部 API Key 带来的依赖边界。
2026.08.18半年副业做到小红书 2 万粉:我的选题记录、制作流程与三类收入我用半年时间把小红书做到 2 万粉丝,发了 149 个作品,整理了从选题、口述大纲、录制剪辑到字幕、封面和多平台分发的副业流程,也记录了商单、咨询和培训这三类收入。文中保留了视频里 149 个作品和后文 160 条内容的原始口径差异。
2026.08.18从语音转写到多模态看画面:我给视频字幕搭的四层纠错流程我把视频字幕从单次语音识别改成了四层纠错流程:先用 FunAudio 转写,再通过错词库、语义检查和画面文字识别修正术语,最后预览、修改并烧录视频。
2026.08.16用 DeepSeek Harness 搭建内容工作台:把本地目录与创作工具收进同一个界面我利用 DeepSeek Harness 的插件机制改了界面,把本地内容目录、内容详情、封面和字幕工具接进同一个工作台,并用 Current Content 把当前条目交给 Agent 作为上下文。这个工作台开发了一天,自动化依赖本机工具,仍在继续完善。
2026.08.15我把 GLM-5.3 放进前端工作流:三类真实任务的设计表现与工具边界我把 GLM-5.3 放进前端工作流,用短提示词生成 HTML 页面、用 Skill 完成网页动画,再参与 Selector Pro 浏览器扩展开发。这几次实测里,我看到它在网页界面和视觉设计上的表现最突出,但截图反馈依赖 Z Code 提供的视觉工具。
2026.08.14我实际安装了 DeepSeek Harness:四种运行模式与插件扩展体验我实际安装了 DeepSeek Harness,记录从启动 Web UI、配置 API Key 到选择四种模式的过程,又用 dsh-vision 补上图片识别、用 dsh-theme 调整界面主题。安装完成后的判断是,它更像一个可以继续搭建的 Agent 框架,而不是开箱即用的成品。
2026.08.13DeepSeek Harness 与 Grok 4.6 实测:第一方 Agent 预览与日常任务变化2026 年 8 月 13 日,我同时查看了 DeepSeek-V4-Pro 的更新、安装了 DeepSeek Harness,并把日常任务切换到 Grok 4.6。前两者仍处于需要观察的阶段,Grok 4.6 的任务循环、检查和中文表达已经能在实际使用中感受到变化。
2026.08.12海外推文传播之后:一封 22 岁印度读者的来信与我对做 AI 产品的回答一篇推文在海外不断被转发后,我的粉丝从 1000 涨到 6500,还收到一封 22 岁印度学生用英文和中文写来的邮件。信里提到 VibeHub、Selector 和 oil-motion,也让我重新整理了自己进入 AI 产品领域、积累 Proof of Work 和培养产品感的做法。
2026.08.11Codex 负责主线、Kimi 探索设计、Grok 快速执行:我日常协同三款模型的分工实践我把 Codex、Kimi 和 Grok 分工使用:Codex 作为日常主线 Agent,Kimi 负责设计探索,Grok 处理速度优先的明确任务,再通过 Codex 中的子 Agent 和 Agent Island 管理协作与额度。
2026.08.10做 X 海外社媒第一个月:从 0 到 1000 粉丝,我怎样给新项目做冷启动我从上个月开始在 X(原 Twitter)上发布内容,一个月后账号获得了 1000 多个粉丝。回顾这段时间,我把长文章改成精简推文,并用 Grok 分析传播路径,为开源项目和新产品带来第一波流量。
2026.08.10受够了 Mac 跨窗口拖拽文件,我在屏幕刘海里做了个临时中转盒在 Mac 上跨应用拖拽文件时,窗口遮挡经常让操作中断。我在 NotchNotes 里做了一个放在屏幕顶部刘海区域的临时文件盒,先暂存文件,再拖到目标应用完成传输。
2026.08.09我花了一个周末,用 Vibe Coding 做了个个人网站我用一个周末把产品、开源 Skills、视频文章、个人经历和交流入口集中到 oiloil.org,并用首屏互动、迷你产品演示、统一插画和文章转场呈现自己的设计偏好。
2026.08.07用 AI 视频切雪碧图做交互动画:我给个人网站实现鼠标跟随与小狗转头的过程我把个人网站首屏里的小人和小狗做成了会跟随鼠标变化的交互动画:小人的眼睛用网页逻辑驱动,小狗则由 AI 视频取帧,再拼成雪碧图实时映射。
2026.08.05如何将 DeepSeek 配置为 Codex 的子 Agent?把 DeepSeek 接进 Codex,不是把 Codex 整体切换成 DeepSeek,而是让它成为一个可以按需调用的子 Agent:主 Agent 仍然负责理解任务、查看界面和调度流程,边界清楚的代码和文本工作再交给 DeepSeek。
2026.08.03Codex 如何接入 DeepSeek V4 Flash,并配置视觉识别?在 Codex 里通过官方一键脚本接入 DeepSeek V4 Flash,再用 see Skill 给这个纯文本模型补上图片识别能力。
2026.08.02Vibe Coding 的项目如何部署上线?部署上线就是把本地项目放到一台 24 小时开机、可以公开访问的云端电脑上。这篇文章讲清楚国内和海外两种部署方式的区别,以及我自己用 GitHub 加 Vercel 加 Cloudflare 的完整流程。
2026.08.02如何避免 AI 味儿文案和 AI 味儿设计?AI 写的文案和做的页面都有典型的 AI 味。我在 VibeHub 增加了防止 AI 味儿模块来集中整理这些问题,并用 oil-tone 和 oil-frontend 两个 Skill 分别约束 AI 写的文案和前端代码。
2026.07.31GPT-5.6 Luna 降价 80%,DeepSeek V4 Flash 正式版上线GPT-5.6 Luna 降价 80%,输出价格到了每百万 token 0.6 美元;同一天 DeepSeek V4 Flash 正式版上线,能力超过 V4 Pro,输出价格只要 0.18 美元。接入自己的 Agent 时,我推荐 DeepSeek V4 Flash。
2026.07.30个人开发者如何接入支付?国内支付平台不对个人开放,个人产品接入支付可以走 Stripe:先去香港开一张 ZA Bank 储蓄卡,再用中国护照完成 Stripe 身份认证,最后通过 Stripe 的连接器让 AI 完成接入。
2026.07.29VibeHub 新功能:移动端适配、术语扩充和练习模块Vibe Coding 术语网站 VibeHub 最近的一次更新:一镜到底动画和浏览器返回行为对齐、移动端左右滑动切换词汇、产品和测试分类补充了一批新术语,另外新增了术语投稿入口和练习模块。
2026.07.28Vibe Coding 怎么获取灵感和发现用户需求?现在 AI 已经足够强,但很多人不知道应该做什么产品。我的办法是从自己的小痛点开始做,再用 AI 搭配社媒调研工具验证真实需求,这篇文章整理了完整过程。
2026.07.28在 Codex 里用 Quick Chat 调用 GPT-5.6 ProCodex 之前的 New Chat 小弹窗没有消失,而是挪进了 Quick Chat。在这里可以直接使用 GPT-5.6 Pro 讨论方案,对话不占用 Codex 的正常额度,还能把结果引用回当前任务。
2026.07.27做完产品,把它发到社媒上我用两天时间做完了 VibeHub 这个 Vibe Coding 术语网站,发到社媒之后不到五天访客量就超过了一万。这次发布让我确认了一件事:社媒不只是推广渠道,也是验证需求、收集真实用户反馈的地方。
2026.07.26从 0 到 1 上手 Skill:是什么、怎么装、怎么写一期 Skill 入门内容的文字版:Skill 本质是一个有固定格式的文件夹,安装就是把文件夹放进 Agent 的 Skill 目录,创建和测试都可以交给 Agent 完成,写的时候注意它是给 Agent 看的。
2026.07.25VibeHub 第一轮优化:列表页密度、术语可视化和 VibeHub SkillVibeHub 上线第一天有 2000 多个用户访问。根据社媒上的反馈,我调整了列表页的信息密度,把卡片描述换成大家平时跟 AI 说话的方式,给 PRD、MVP、身份认证等术语补上可视化示例,并做了一个 VibeHub Skill。
2026.07.24我日常使用频率最高的 10 个 Skill整理我日常使用频率最高的 10 个自研开源 Skill,覆盖代码提交、子 Agent 派发、视频剪辑、封面生成、多平台发布、文风规范、插图生成和 README 美化。
2026.07.23VibeHub:一个 Vibe Coding 术语学习网站我做了一个 Vibe Coding 术语学习网站 VibeHub,把前端组件、后端、Git 和设计风格的常用术语整理在一起,每个术语都有示例、使用场景和组成结构,帮助大家更准确地跟 AI 描述需求。
2026.07.23Qwen3.8-Max-Preview 实际使用体验在 Qoder 里用 Qwen3.8-Max-Preview 完成了三个实际任务:一个跑了一整晚的全站国际化、一句话生成的狼人杀 HTML 原型、基于 PPT Skill 做的演示文稿,记录它在长任务执行、前端和文案上的表现。
2026.07.23Qoder Security:给 AI 写的代码做安全检查Qoder 把代码安全扫描做成了内置功能,分为静态检查、轻量扫描和深度扫描三个级别。我用它扫了自己一个已经上线的项目,记录这三个级别的区别和实际扫描过程。
2026.07.20Codex 子 Agent 的使用技巧Codex 的子 Agent 可以并行执行任务、指定更便宜的模型、控制主线程的上下文增长,但派发时默认不会遵循自定义 Agent 里配置的模型。这篇文章介绍我的子 Agent 配置和几个约束技巧。
2026.07.19分享一下我如何成为一个 AI 产品经理我从前端开发转到产品经理,再通过使用 AI 工具、自己开发 AI 应用和持续输出内容,进入了一家真正开发 AI 应用和 Agent 的公司。这篇文章按照自己的经历把这条路径梳理一遍。
2026.07.19从 0 到 1 构建 AI 应用:需要了解的基础知识开发一个 AI 应用之前,需要先理解 API、API Key、多模态、上下文、TPS 这些概念,以及怎么在 API 平台上挑选模型并接入自己的服务。这篇文章用一个狼人杀游戏的例子把这些基础知识串了一遍。
2026.07.18Kimi K3 实际使用体验Kimi K3 是我用过的第一个真正达到 Claude Opus 级别的国产模型:设计和前端调试能力对标 Claude Fable 5 和 GPT-5.6 Sol,价格比 Opus 便宜一半,但官方订阅额度和 Kimi Code 的软件体验还跟不上。
2026.07.17我开源了多平台视频自动发布 Skill手动发布一个视频到四个平台需要 10 到 20 分钟。我把这个环节做成了 Codex Skill:自动上传视频、填写标题、话题和封面,最后停在发布前等我确认。
2026.07.17GPT 5.6 的三个模型怎么分工GPT 5.6 在 Codex 里提供了 Luna、Terra、Sol 三个档位。我的用法是让一个 Sol Extra High 的主 Agent 负责思考和分配,再按任务类型把工作派给不同档位的子 Agent。
2026.07.15给 GitHub 仓库主页生成 SVG 徽标我开发了一个 Skill,可以给 GitHub 仓库生成 SVG 徽标、整理 README 设计,让访客打开仓库就能看懂项目是做什么的。上线一天多已经有 400 个 Star。
2026.07.14Codex 的两个新特性和一个实用技巧GPT-5.6 之后 Codex 更新了不少功能,这篇介绍其中两个新特性:输入框 @ 自定义 Agent 和话题、对话内的可视化交互表单,以及一个解决 ImageGen 生图后线程卡顿的技巧。
2026.07.13GPT 5.6 在 Codex 里深度使用几天后的心得这几天用 GPT 5.6 Sol 加 Extra High 深度使用 Codex,一天就用掉了 50% 的周额度。记录思考档位的选择、不用 Goal 也能长时间稳定执行的变化、UX 和 UI 设计能力的提升,以及指令理解上的进步。
2026.07.12什么模型的文案比较有人味?我用同一份字幕稿让多个模型分别转成文章,对比谁的文案更有人味。目前写得最自然的是 Claude Opus 4.6,LongCat 2.0、千问 3.7 Max 和 Claude Sonnet 4.6 也可以用。
2026.07.12用 Codex 从零到一做个人网站一场 AI 产品经理训练营分享的文字整理:先讲清楚 AI 产品经理、Vibe Coding 和 Agent 的基本概念,再用 Codex 从零做出一个个人网站,过程中涉及 Skill、联网调研、浏览器自动化和子 Agent 的用法。
2026.07.10Grok 4.5 实测:UI 设计能力比 Gemini 3.1 Pro 更强我用 Grok 官方 CLI 实测了 Grok 4.5。它的原生 UI 设计能力已经超过了 Gemini 3.1 Pro,图片可以并行生成,一个狼人杀落地页从提示词到完成只花了 3 分钟。
2026.07.10GPT 5.6 上线第一天,我在 Codex 里的实测Codex 更新后上线了 GPT 5.6,分成 Sol、Terra、Luna 三个档位。我用了一整天,记录三个模型的分工和价格、新增的 Ultra 思考档位、子 Agent 行为的变化,以及明显变快的额度消耗。
2026.07.08混元 Hy3 正式版在 WorkBuddy 里的实际使用感受混元 Hy3 正式上线后,我在 WorkBuddy 里测了两个 case:用很短的提示词生成狼人杀原型并直接实现成可玩版本,以及用深度调研专家生成个人网站,顺带验证了它对大文件的编辑稳定性。
2026.07.07为什么 Codex 这么难驾驭?用 Codex 写页面、文档和代码时,它会把本该回复给我的消息写进产物,热衷于 fallback 和特判逻辑,也很少在动手之前反问。这篇文章整理这几个问题和它们带来的实际影响。
2026.07.05如何使用 Codex 定制有设计感的图标?用 GPT Image 2 一次生成一张 4×4 的图标图,再切图、抠图,得到一套风格统一的透明图标。这套流程我打包成了开源的 oil-icon Skill,可以在 Codex 里直接安装使用。
2026.07.04Codex 从 0 到 1 上手从一个真实的调研任务出发,介绍 Codex 的项目管理、联网调研、浏览器自动化、图片生成、子 Agent 和 Skill 的用法。
2026.07.03Nano Banana 2 Lite 实测:对比 Nano Banana 2 和 GPT Image 2Nano Banana 2 Lite 的价格是 Nano Banana 2 的一半,速度更快。我用人像、插画、UI、海报、电商长图、人物一致性等场景实测对比了它和 Nano Banana 2、GPT Image 2:不带文字的图差距不大,涉及文字基本不可用。
2026.07.02Claude Fable 5 的实际使用感受我用 Claude Fable 5 完成了一个落地页的前端实现,并让它优化了自己的几个 Skill。它在设计能力、视觉理解和指令遵循上明显强于 Opus 4.8 和 GPT 5.5,但开销是 Opus 4.8 的两倍。
2026.07.01如何使用 AI 自动化发布多平台视频?我写了一个 video-publisher Skill,让 Codex 生成视频标题和标签、按平台拆分发布清单,再派四个子 Agent 在自动化浏览器里分别完成小红书、抖音、B 站和视频号的发布,最后由我人工确认。
2026.06.29Selector Pro:把页面上的图片直接转换成生图提示词Selector 的浏览器拓展版 Selector Pro 可以读取页面上的图片,直接生成结构化的生图提示词,这篇文章演示它的读图和生图效果。
2026.06.27Codex 和 Claude 的桌面端与模型对比Codex 和 Claude 的桌面端在产品设计上取向不同,背后的模型也有各自的特点。这篇文章整理我深度使用这两个产品之后的观察,以及我目前如何把两个产品搭配在一起使用。
2026.06.27云端的 Agent,都需要一台自己的云电脑本地 Agent 能干活,是因为我们把整台电脑借给了它。云端 Agent 的厂商没法借用户的电脑,需要自己解决完整系统、安全沙箱、弹性算力和持久化记忆这四件事,云电脑正好对上这四条。
2026.06.26Selector 更新:写轮眼模式,复制页面完整设计让 AI 复刻Selector 新增写轮眼模式,可以把页面上某个区域的完整元素设计(DOM、样式、字体、动画)连同截图一起复制成提示词,让 AI 直接把整个设计复刻成 HTML。
2026.06.25我把生成视频封面的 skill 开源了上一期介绍的封面生成 skill 已经开源,叫 oil-cover。这篇文章讲怎么安装和使用它,以及它背后的执行流程和两种模式。
2026.06.24我用 Codex 做了一个生成视频封面图的 skill我给自己做了一个生成视频封面图的 skill,可以同时生成横版和竖版。这篇文章记录它的封面构成、提示词的打磨过程,以及为什么最后把流程写成了脚本。
2026.06.22Codex 的子 Agent 功能和使用方式Codex 内置了完整的子 Agent 机制,但默认不会主动调用。这篇文章介绍它的工具、配置分层和我自己的使用方式。
2026.06.19Qoder + Qwen3.7-Max 的实际使用效果用 Qoder 搭配 Qwen3.7-Max 完成了一次真实的功能开发、一次单文件 HTML 生成和一次小红书数据自动采集,记录这套组合在实际开发工作流里的表现。
2026.06.18让 Gemini 成为 Agent 的设计顾问把 Gemini 接进 Agent 的设计工作流:Gemini 只负责设计判断,Codex 这类 Agent 负责读项目和改代码。我把 Gemini Designer skill 改成了一个 CLI 加四个命令的结构,已有的 UI 通过 advise 命令拿到精细化的设计建议。
2026.06.14如何把 AI 生成的 HTML 一键发给别人看Vercel 新功能 Drop 可以把一个 HTML 文件或文件夹直接拖进浏览器完成部署,拿到一个公开域名。这篇文章介绍它的使用过程,以及它解决的 HTML 分发问题。
2026.06.13我如何用 Gemini 搭配 Codex 做 UI 设计我在给自己的 AI Agent 做拟物化 UI 时,用 Gemini 出设计意向和 HTML 设计稿,再让 Codex 参考设计稿实现到系统里。这篇文章记录完整的流程和几个提示词心得。
2026.06.12配置 Agent 这件事,也可以交给 Agent我第一次装 OpenClaw 是让 Claude Code 帮我装的,后续调模型、清理工作区也交给它处理。顺着这个经历聊一聊:为什么 Agent 的配置应该交给 Agent 自己打理,以及 Claude Code、Codex、QoderWork 已经做了什么。
2026.06.11分享一下我的语音输入工具我用过 Wispr Flow、Typeless 和智谱 AutoGLM,现在用的是闪电说,搭配千问的实时语音识别模型。这篇讲一下我的选择和配置方式。
2026.06.11Ego Lite:为 AI Agent 设计的浏览器Ego Lite 是一个给 AI Agent 做浏览器自动化的桌面浏览器。它把人和 Agent 的操作隔离在各自的 Space 里,并且让 Agent 通过写代码而不是逐条执行命令来控制浏览器。
2026.06.06如何用 Codex 管理一个长期项目Codex 左侧栏的 Projects 和 Chats 分别适合什么任务,以及我怎么用 AGENTS.md、项目级 Skill 和文件化的工作流,在 Codex 里长期维护一个小红书内容项目。
2026.06.05Codex Chrome 插件的安装和使用Codex 的 Chrome 插件可以让 Codex 直接操作浏览器执行自动化任务。这篇文章记录从安装插件到让它把我的小红书后台数据整理成表格的完整过程。
2026.06.04Codex 里的插件、Skill、App 和 MCP 分别是什么Codex 最近的更新增加了数据分析、产品设计、销售、创意等职能类官方插件。这篇文章梳理 Codex 里插件、Skill、App、MCP 这几种资源的关系,以及官方插件里一种可交互的消息类型。
2026.06.01让 Codex 扫描历史对话,把重复流程封装成 Skill 和提示词经常发给 AI Agent 的短指令可以固化成提示词,重复的流程可以让 Agent 扫描历史对话后整理成 Skill。这篇文章介绍 Codex 的提示词用法、我的扫描提示词,以及一次实际的扫描结果。
2026.05.30阶跃 Step 3.7 Flash 上手体验阶跃新发布的 Step 3.7 Flash:256K 上下文、输出每百万 Token 2 元、原生多模态加官方联网搜索。我把它配进自己的 Agent,做了旅行攻略、设计风格模仿和深度调研三个测试。
2026.05.29Claude Opus 4.8 更新了什么Claude Opus 4.8 是一次小幅更新:上下文长度和价格不变,主要增强了 Agent 和编程能力,语言交流感比 4.7 有所回升,同时 Claude Code 增加了 Dynamic Workflow,快速模式也降价了。
2026.05.26Codex、Gemini 3.1 Pro、Gemini 3.5 Flash 的设计能力对比我在做一个社媒 Agent 的官网时,用相同的提示词对比了 Codex、Gemini 3.1 Pro 和 Gemini 3.5 Flash 的设计能力。结论是 Gemini 3.1 Pro 依然顶级,这篇文章是对比过程和我的观察。
2026.05.25Gemini 3.5 Flash 的实际使用感受我在 Cursor 里实际用了一段时间 Gemini 3.5 Flash:价格比上一代 Flash 贵了三倍,编程 Agent 能力算是可用了,真正的优势在文案、输出速度和视觉识别。
2026.05.24一个查看 Codex Token 消耗的 SkillCodex 软件和官网都看不到详细用量,我写了一个 Skill 直接读取本地 SQLite 数据库,生成中文的 Token 消耗报告,支持按月份、来源、模型查看趋势和明细。
2026.05.23Codex 官方最佳实践和我的使用解读Codex 官方团队发了一篇 Getting the most out of Codex,讲怎么用好 Codex。这篇整理里面的要点:线程、语音输入、消息排队、调研工具、Automation、Goals、Side chat 和共享记忆,并附上我自己使用时的做法和提醒。
2026.05.19我做了一个藏在 MacBook 刘海里的便签工具 NotchNotes我给自己开发了一个藏在 MacBook 刘海里的便签工具 NotchNotes:鼠标划到刘海下方就会展开,支持分组和 Markdown 实时渲染,已经在 GitHub 开源。
2026.05.17HTML 真的比 Markdown 更好吗?拆解 Anthropic 工程师「用 HTML 替换 Markdown」的观点:HTML 在 Agent 输出里的优势、对普通人不划算的成本,以及一个更省 token 的折中做法。
2026.05.15Codex 节省上下文的三个技巧Codex 搭配 GPT-5.5 的上下文只有 20 多万,多问几个问题就容易到上限。这篇分享三个应对技巧:清理 Plugin 带进来的冗余 Skill、用 explore Skill 让子 Agent 先定位代码、用 /side 开启独立的侧边对话。
2026.05.13Codex 的 /goal 命令:设定目标后持续执行直到完成Codex 的 /goal 命令可以给 Agent 设定一个带终止条件的目标,让它跨多轮持续执行直到达成。这篇文章介绍开启方式、和普通任务的区别,以及搭配 caffeinate 长时间运行的做法。
2026.05.11Open Minis:iPhone 上的本地 AI AgentOpen Minis 是一个 iOS 上的本地 AI Agent,工作环境完全在手机系统里,可以自己配模型、装 Skill、管理记忆。这篇文章分享我的配置和实际使用方式。
2026.05.08Codex 的 Chrome 插件,控制你正在用的浏览器Codex 新出的 Chrome 插件可以通过浏览器拓展直接控制我们正在使用的浏览器,复用已有的登录态。这篇文章对比它和 Agent Browser、Browser MCP、Manus My Browser 的区别,并介绍我自己实现的同类工具。
2026.05.05我从多模型组合换成了 Codex + GPT 5.5之前我用 Claude、Codex、Gemini 三个模型分工做 vibe coding,最近两周已经完全换成 Codex 加 GPT 5.5 一个组合。这篇文章说说换的原因,以及设计工作现在怎么解决。
2026.05.03Codex 桌面宠物:三个新形象和它的实现原理上一期用 hatch pet 孵化了小狗钱钱,这期又制作了高达、宇智波鼬和巴达兽三个形象,并拆开看了看桌面宠物的动作素材是怎么生成和组装的。
2026.05.02Codex 桌面宠物:自定义形象,还能显示任务进度Codex 桌面端最近推出了桌面宠物功能。宠物形象可以用 hatch pet 这个 skill 自己孵化,孵化好之后它会待在桌面上,实时显示 Codex 的任务进度。
2026.04.30混元 Hy3 preview 在 WorkBuddy 里的实际使用体验混元 Hy3 preview 开源后,我在 WorkBuddy 里实际测了几个 case:生成清朝皇帝介绍网页、用 Panova skill 把两个代码库解析成产品报告,另外试了微信小程序接入和腾讯文档集成。
2026.04.27如何把 AI 生成的 UI 设计稿还原成 HTML把 GPT Image 2 生成的设计稿还原成 HTML 的方法:代码能实现的结构直接搭骨架,Logo、插画这类代码写不出来的元素分离成素材单独图生图,最后用截图对比做一轮后验校验。
2026.04.26用 GPT Image 2 生成风格稳定的 UI 设计稿用 GPT Image 2 给已有系统设计新页面的 UI:统一提示词控制不了风格一致,参考图可以;把参考图的内容区留空、只保留外框,还能给模型留出创造力空间。验证过的提示词策略我打包成了 draw-ui 这个 Skill。
2026.04.25我把主力模型从 Claude Opus 4.7 换成了 GPT 5.5GPT 5.5 发布后我深度使用了两天,文案和理解能力明显比 GPT 5.4 好,配合 Codex 的 Fast 模式和宽裕的额度,对我来说已经可以替代 Claude Opus 4.7。
2026.04.23用 GPT Image 2 生成 UI 设计稿的实际效果我用同一套提示词对比了 GPT Image 2 和 Nano Banana Pro 生成 UI 设计稿的效果,GPT Image 2 在稳定性、图标准确度和可落地性上都明显更强,我已经把自己的生图 Skill 切到了它。
2026.04.18Claude Opus 4.7 的实际使用感受Opus 4.7 发布后我在 Cursor 里深度使用了两天,编程能力明显提升,上下文消耗更慢,但语言表达变得生硬了一些,设计能力则没有什么变化。
2026.04.17Claude Opus 4.7 的官方最佳实践Opus 4.7 发布当天,Anthropic 同时发了一篇官方最佳实践文章,新增 X-High 思考程度,默认响应更短、更少调用工具和子代理,Cursor 上已经可以使用并有发布期五折。
2026.04.16Claude Code 调用 Codex 和 Gemini 的多模型开发方式我在 Claude Code 里建了两个 Skill,一个把代码执行交给 Codex,一个把设计任务交给 Gemini,由 Claude Code 按任务类型自己调度。这篇文章介绍这种做法在省钱、互审和上下文精简上的实际效果。
2026.04.15用零代码平台 Meoo 秒悟做了一个 NBTI 测试网站体验了零代码应用开发平台 Meoo 秒悟:模型选择、技能集市、Swarms 蜂群模式、内置云服务和一键发布,并用它实际做了一个 NBTI 人格测试网站。
2026.04.14个人开发者推广产品的六个渠道我上线过三四个产品,最多的一款有一万多个用户。这篇文章整理我自己在用的六个推广渠道:技术社区投稿、GitHub Awesome 列表、SEO、社媒分发、国内 AI 平台和海外 TikTok,以及每个渠道的实际做法和效果。
2026.04.12Vibe Coding 怎么少花点钱我在 vibe coding 里控制开销的几个方法:按任务混合使用不同的模型,能用脚本完成的事情不交给 AI 执行,再用 RTK、Skills 和对话管理减少上下文里的无效 token。
2026.04.12Codex 自带 Skill Creator 里的 Skill 设计原理现在创建 Skill 大多交给 AI 生成,但没有人提供 knowhow 的 Skill 帮助有限。Codex 自带的 Skill Creator 把 Skill 的加载机制和设计原则写得很清楚:上下文窗口里始终只有 name 和 description,正文、脚本和参考资料按需加载。
2026.04.11Claude 的 Advisor 工具:给执行模型配一个 Opus 顾问Anthropic 推出了 Advisor 工具,让 Sonnet 或 Haiku 作为执行模型跑完整任务,遇到复杂决策时通过一次工具调用向 Opus 请求建议,在控制成本的同时提升任务表现。
2026.04.09用 AI 给狼人杀游戏做 UI 设计和美术资源我在黑客松做的 AI 狼人杀 Wolfcha,不少人反馈 UI 做得挺成熟。这篇文章分享整个做法:Gemini 出单文件设计稿再换模型同步进系统、Phosphor 图标库,以及用 OpenCreator 图生图批量生成立绘。
2026.04.08我每天在用的五个 AI Skill五个我日常高频使用的 Skill:Claude Code 调 Codex 写代码、OpenCode 加 GLM 处理前端、扫 git 记录生成飞书日报、一条命令走完发布流程、生成单文件 HTML 幻灯片。
2026.04.06Panova:把代码仓库变成产品经理能读懂的可视化报告我新开发并开源了一个 Skill,让 AI 读取存量的产品设计文档或代码仓库,生成一份包含业务逻辑、目标用户、用户旅程和可视化演示的报告,帮助产品经理快速上手一个项目。
2026.04.06Claude Code 内置课程 /powerup:10 个常用命令Claude Code 新版本内置了一个 /powerup 命令,里面是一个 10 节课的小课程,覆盖 @ 引用文件、权限模式、撤销、后台任务、CLAUDE.md、MCP、Skills、子 Agent、远程控制和模型选择。这篇文章把每节课的内容和实际用法讲一遍。
2026.04.03Claude Code 安装入门和常用命令从零安装 Claude Code 的完整过程,包括官方脚本和智谱 GLM 文档两种安装方式、模型配置方法,以及 resume、rewind、compact、insights、simplify 等常用命令的用法。
2026.04.02第一个 AI Agent,我推荐 Cursor完全没有用过 AI Agent 的人,面对 Claude Code、Codex、OpenClaw 和各种模型很难下手。我推荐把 Cursor 作为第一个上手的 AI Agent,因为它有图形界面、聚合了多个顶尖模型,也不和单一模型厂商绑定。
2026.03.31Selector 更新:方向键切换元素、空格暂停选择和撤销Selector 书签的一次更新:工具栏加了快捷键提示,支持方向键切换元素层级和相邻元素,空格暂停选择模式,以及 Command+Z 撤销选择。
2026.03.31Selector:选中页面元素,直接复制成给 AI 的修改提示词Selector 是我 vibe coding 的一个浏览器小书签,点击页面上的元素就能复制出带位置信息的提示词,方便向 AI Agent 描述要修改的位置。
2026.03.29codebase-to-course:把代码库转成可视化课程的 Skill体验 Zara Zha 开发的 codebase-to-course Skill:把一个代码仓库转成带可视化数据流和小测验的 HTML 课程,以及我在使用中发现的速度问题和优化思路。
2026.03.29CityCraft 落地页 Skill 的优化和实际效果我给生成落地页的 CityCraft Skill 做了一次优化,修复了自己发现的问题和用户反馈的问题,精简了选项并增加了复制提示词的兜底方案,这篇文章用一个实际示例演示现在的使用效果。
2026.03.27我把剪辑录屏和加字幕的 Skill 开源了我把用 Claude Code 剪辑 Screen Studio 工程、给视频加 AI 校对字幕的流程做成了一个 Skill 并开源,名字叫 Screen Studio Editor。这篇文章介绍它的安装方式和完整使用流程。
2026.03.26安装 Computer Use skill,让 Claude Code 爬取飞书群消息Computer Use 是一个让 Claude Code 直接操作 Mac 的 skill,通过截图、模拟鼠标点击和键盘输入,完成没有 API 的应用里的自动化任务。这篇演示它的安装过程,以及用它爬取飞书群聊最近消息的实际效果。
2026.03.26用手机远程控制电脑上的 Claude CodeClaude 桌面应用新增的远程控制功能需要订阅官方套餐才能使用。对于把 Claude Code 接在第三方渠道上的情况,可以通过 OpenClaw 或 Happy 从手机发消息给电脑上的 Claude Code,再配合 computer-use skill 让它直接操作电脑。
2026.03.24我把 AI 生成的贴纸定制成了实物之前用 AI 工作流生成的 10 张贴纸,我找厂家定制成了实物。这期展示磨砂防水材质的实际效果,以及为什么贴纸最好贴在保护壳上而不是机器上。
2026.03.23OpenClaw 和 Claude Code 的差别OpenClaw 和 Claude Code 的能力上限差不多,区别在于产品取向:一个擅长 IM 里的轻量日常任务,一个擅长工程级的编程任务,两个工具可以同时使用。
2026.03.21我把 Screen Studio 剪辑 Skill 又优化了一版之前分享过用 Claude Code 加自制 Skill 剪辑 Screen Studio 工程和生成字幕。这次基于实际使用修复了剪辑点过渡失效的问题,新增了字幕预览编辑器和合并两个工程的能力。
2026.03.20如何找到并安装一个 Skill一个 Skill 本质上是一个带 SKILL.md 的文件夹。这篇文章介绍四种找到并安装 Skill 的方式:手动下载解压、npx skills add 命令、Skills 市场,以及直接让 AI Agent 帮忙安装。
2026.03.19MiniMax M2.7 搭配 OpenClaw 和 Claude Code 的使用体验MiniMax M2.7 发布后,我把它接进了 OpenClaw 和 Claude Code 实际用了两天,日常开发已经把 Sonnet 4.6 换成了它。这篇记录速度、长上下文、大文件编辑和联网配置上的真实表现,以及套餐价格。
2026.03.18Claude 开放 100 万上下文,Sonnet 4.6 的一周使用体验Claude 把 100 万上下文正式开放给 Opus 4.6 和 Sonnet 4.6,按标准价格计费,不再额外收费。我因为一次配置改动,在没发现的情况下用了一周 Sonnet 4.6,没有感知到它和 Opus 4.6 的差别。
2026.03.15CityCraft:一个生成有设计感落地页的 Skill我开发了一个叫 CityCraft 的 Skill,把落地页的配色、排版和导航风格做成可视化的选择卡片,让不同的 AI Agent 都能做出有设计感的产品官网。这篇文章介绍它的安装和完整使用过程。
2026.03.15CityCraft Skill 优化:选择结果一键回传给 Agent我把生成落地页的 CityCraft Skill 优化了一轮,在 HTML 选择页上点击就能直接把选择结果回传给 Agent,不需要再手动复制,这篇文章用一个图书收藏网站的例子演示完整流程。
2026.03.14我的日常视频录制流程和用到的工具分享我平时录视频的完整过程:用 Screen Studio 录制和剪辑,再把停顿剪辑、专业名词校对和加字幕这些步骤交给 Claude Code 里的自制 Skill 自动完成。
2026.03.14BulkGen 生图实测:三种模式和实际成本演示我自建的 AI 生图工具 BulkGen 的单图、组合、抽卡三种模式,以及每种模式生成一张图实际花多少钱。
2026.03.13skill-creator 更新和我的 Codex Skill 优化记录Anthropic 的 skills 仓库更新了 skill-creator,新增了 Skill 性能评估功能。我参考它的新规则优化了自己的 Codex Skill:触发条件改为显式请求、PTY 环境自动降级、过滤探索命令减少上下文,并根据使用日志补充错误处理。
2026.03.13把 OpenAI 的 Harness Engineering 用到自己的项目里OpenAI 的 Harness Engineering 讲的是给 AI 设计一套能持续可靠工作的规则和环境。这篇文章把里面的实践对应到 Claude Code:生成 CLAUDE.md、把知识写进仓库、用 Hook 强制执行检查、让 AI 自己看日志和操作浏览器、定期清理坏模式。
2026.01.25我日常的 AI 编程工具:Cursor 和 Windsurf我平时写代码主要用 Cursor 和 Windsurf 两个 AI IDE:Cursor 按 token 计费,适合强弱模型分阶段搭配;Windsurf 按额度计费,适合开销大的长任务。这篇整理我的模型搭配方式和几个使用技巧。