工具笔记

62 篇内容

工具笔记Fzakaria Blog

Hiding my AI slop from my Nix friends

文章讨论作者如何在使用 AI 编码代理时,避免自己和代理产出“AI 腔”文本。他把 home-manager 的 agent-settings.nix 声明式生成 ~/.claude/CLAUDE.md 与 AGENTS.md,汇总维基百科和 Simon Willison 的 AI 写作特征,禁用 delve、tapestry 等词及“不是 X 而是 Y”等句式。发现提示无法稳定约束后,他复用代理自己写出的 tools/check-prose.py,在 CI 中以确定性检查拦截禁用词、短语和破折号,认为可验证、可复现的检查优于上下文提示。作者还统计历年博文,发现 2025-2026 年破折号与违禁词明显上升,并引用 Goodhart 定律提醒该指标本身会失效。内容偏个人实践与反思,缺少系统评测和推广验证。

推荐收录,因为它给出可迁移的具体做法:用可运行、可验证的 CI 脚本来约束 AI 生成代码与文档的写作风格,而不是依赖易被忽略的提示词,并用 Goodhart 定律诚实地指出该指标的局限。适合在仓库中大量使用编码代理、关心代码与文档风格的工程读者参考;风险是内容以个人实践为主,样本和评测有限。

工具笔记Simon Willison

Kākāpō Party

文章记录了作者为 WeAreDevelopers 大会闭幕演讲制作像素动画的完整流程。他先把三张鸮鹦鹉照片与提示词交给 Claude,让其用 HTML5 Canvas 生成至少 20 只像素鹦鹉跳跃、撒彩带的动画页面。随后他让本地 Claude Code 会话用 Playwright 加载该 HTML,按预设时间点在画布中心、四角与边缘依次点击以触发彩带效果,并录制 15 秒视频嵌入 Keynote。文中给出了可直接复用的 Playwright 脚本,通过 record_video_dir 录屏、按时间轴点击并等待到 16 秒收尾。该方案适合浏览器内交互动画的自动化录制,但坐标与点击时机强依赖具体页面,跨场景迁移需重新标定。

推荐收录:文中给出完整可运行的 Playwright 脚本,展示了「用 LLM 生成浏览器交互动画 → 脚本化定时点击 → 自动录屏产出视频」的端到端流程,可直接迁移到演讲演示素材、UI 动效录屏或前端回归录制。局限在于点击坐标和时机是为该页面硬编码的,通用性有限,价值主要在可复用的工作流思路与 Agent 驱动开发工具的组合方式。

工具笔记Bram.us

Show keystrokes on a website with the <​show-keystrokes> custom element

文章介绍了一个名为 <show-keystrokes> 的 Web 自定义元素,用于在屏幕录制或现场演示时可视化键盘按键。作者因 macOS 应用被企业安全策略屏蔽且无法在窗口/标签页共享中显示,遂借助 Gemini 构建了该 Web 原生方案。组件可通过 script 标签直接嵌入,也能以书签或 Chrome 扩展注入任意网页。其核心依赖 Popover API 将内容提升至 Top Layer 避免被遮挡,并利用 CSS Anchor Positioning 实现视口固定、跟随鼠标或文档流内定位,同时自动适配平台显示 ⌘/CTRL 等符号。组件支持快捷键、导航键或全部按键的显示模式,并可通过 ::part 和自定义属性定制样式。主要边界是现代浏览器对 Popover 和 Anchor Positioning 的支持,以及该工具主要面向演示场景,Chrome 扩展尚在审核中。

推荐收录,因为文章不仅介绍了一个实用工具,还具体演示了如何用 Popover API 和 CSS Anchor Positioning 解决覆盖层定位与层级问题,并提供了书签和扩展两种注入方式。对于前端开发者、DevRel 或技术讲师,可迁移的是现代 Web API 在免 z-index 覆盖层定位上的实践模式,以及将工具快速分发到任意页面的思路。风险在于依赖较新的浏览器特性,适用范围以演示场景为主。

工具笔记知乎 - 鹅厂架构师

对抗 AI 代码熵增:被低估的独立原子化 commit

文章针对 AI 大规模生成代码加剧代码库熵增的现象,主张以独立原子化 commit 作为结构化降熵手段。作者先给出原子化 commit 的三特征——功能单一、不可拆分、独立可用,再追溯其从 Unix diff/patch 到 Linux 内核 Submitting Patches、再到 Git 范式的演进脉络。随后从逻辑隔离、为 AI 输出建立可审计轨迹、降低协作信息熵、对抗代码腐烂、减少对高级模型依赖五个维度论证其价值,并提出 CI/CD 层 AI 分析器、IDE 实时引导、度量与文化三层落地路径。不足是落地设想偏理想化,后记引用的 TypeSafe AI Jev 模型来源可疑,且缺少真实数据验证。

推荐收录。文章虽属观点型实践总结,但把原子化 commit 从 Git 常识提升为应对 AI 代码膨胀的工程纪律,给出历史依据、五个作用机制以及 CI/CD、IDE、度量三类可落地手段,对使用 AI 辅助编码、负责代码审查与质量治理的团队有直接迁移价值。风险在于 Jev 模型等外部引用可信度存疑、落地设想缺少数据支撑,读者需自行甄别。

工具笔记DuckDB Engineering Blog

DuckDB Now Ships inside dbt v2

文章介绍 dbt v2(基于 Rust 的 Fusion 引擎)首次内置 DuckDB 适配器。作者回顾 v1 需单独安装 Python 包 dbt-duckdb,而 v2 改为 Rust 单仓 + ADBC 驱动,并自动下载缓存 DuckDB 驱动,配置一个 profile 即可运行。v2 新增 DuckLake 与 Iceberg REST 目录支持(需 use_catalogs_v2 标志)、将 dbt 元数据写成可查询 Parquet、提供原生 SQL 语义理解与列级血缘,并固定 DuckDB 版本以推下更多原生函数。迁移可先在 v1.12 用 opt-in v2 parser 验证,再用 dbt-autofix 和升级指南切换。文章偏功能与用法说明,缺少性能基准和取舍分析,适合使用 dbt/DuckDB 的数据工程读者。

推荐收录:文章给出了 dbt v2 内置 DuckDB 的配置方式、DuckLake/Iceberg catalog、Parquet 元数据查询和迁移路径,属于可操作的工具集成参考。适合数据工程师和分析工程师了解本地 dbt 工作流及 v2 迁移。需注意它偏功能公告,缺少性能与取舍验证,版本锁定可能带来后续适配成本。

工具笔记Bram.us

Ship cleaner packages (without the ./dist or ./src folder) by publishing a subfolder to NPM

文章讨论 npm 发布包时 dist/ 或 src/ 目录名泄漏到 CDN 导入路径、污染公开 API 的问题。作者提出用 npm publish ./dist 将 dist 子目录当作包根目录,使构建产物直接位于发布包顶层,得到不带 dist/ 前缀的干净导入路径。为落地该方案,需在构建后把 package.json、README.md、LICENSE 等复制到 dist,并重写 package.json 中 main/module/exports 路径,同时可删除内部 scripts。文中给出零依赖 postbuild 脚本,并用 prepublishOnly 配合 PUBLISH 环境变量阻止误运行 npm publish,要求改用 npm run pub。还介绍 dry-run 与 npm pack 检查 tarball 的验证方式;局限是 NPM 尚未原生支持 publishDirectory,方案需额外维护构建后处理。

推荐收录。文章不仅介绍 npm publish ./dist,还给出 postbuild 复制与重写 package.json 的完整脚本、prepublishOnly 防误发布和 dry-run/npm pack 验证流程,属于可直接复用的发布工程经验。适合维护 npm 包、前端库或 CDN 分发的开发者;风险是该方案依赖手动后处理,且 NPM 尚无原生 publishDirectory 支持。

工具笔记Netflix TechBlog

Leave the Class Path in the Rearview Mirror

Netflix JVM 生态团队介绍 ja 及其可组合命令行工具集(jig、jfmt、jist、jdocserver),目标是让 Java 模块系统成为项目描述的完整载体,并提供现代 CLI 和面向编码代理的开发体验。文章把模块描述符扩展为包含依赖版本、主类、访问授权等元数据,并用 Maven Central 的命名空间与约定为模块建立可验证坐标,解决大量自动模块和传统 classpath 项目的命名发现问题。工具层面强调可组合、可进程内运行,并通过 module-info.hash 持久化哈希保证依赖完整性,同时把注解处理显式化为可审查的代码生成步骤。作者主张所有 Java 项目都应模块化,鼓励库作者发布显式模块。当前 ja 仍为预览,工具稳定性和生态迁移成本需要后续验证。

推荐收录,因为文章不只是发布预告,而是给出了 Java 模块化工具链的具体设计:模块描述符承载依赖与授权、Maven 命名空间映射、哈希完整性校验、注解处理显式化等。适合 Java 平台/构建工具开发者、依赖管理与 Agent 工具链实践者参考;其中关于 classpath 技术债和模块命名/安全边界的讨论可迁移到其他语言生态。风险是 ja 仍处预览,细节可能变化。

工具笔记SpecterOps Research & Tradecraft

CiliumHound: Graphing Kubernetes Network Policies

文章介绍 CiliumHound,一个用于审计 Cilium Kubernetes 网络策略的 BloodHound OpenGraph 扩展。作者先解释 Cilium 作为 CNI 插件如何用 L3/L4/L7 规则实现命名空间隔离,并强调 matchLabels/matchExpressions 内部用 AND、独立 ingress/egress 规则之间用 OR 的组合语义。CiliumHound 摄取 JSON/YAML 策略后生成以命名空间为中心、带方向边的可查图,将 Kubernetes 元素与规则节点连接,并附带保存的 Cypher 查询。文章用直接 egress、endpointSelector egress、ingress、无限端口 egress 和 policy 作用域等例子展示图建模方式。结论是可视化让大量策略变得可消化,但当前尚不支持 nodeSelector 与 CiliumClusterwideNetworkPolicy,pathfinding 也仍未解决。

推荐收录,因为它不止发布一个工具,还完整解释了 Cilium 策略的 AND/OR 组合语义、审计中的实际约束,并给出可复用的图建模与 Cypher 查询方法。适合 Kubernetes 安全评估、红队和平台安全工程师阅读,其图化审计思路可迁移到其他策略密集型场景。主要限制是尚未覆盖 nodeSelector 与 Clusterwide 策略,也缺少 pathfinding 能力。

工具笔记Fzakaria Blog

Visualizing Nix closures

文章介绍作者用 Hilbert 曲线构建的 seenix.dev:一个完全在浏览器本地运行、无需服务端的单页应用,以“一字节一像素”的方式可视化 Nix closure。核心做法是把 closure 内各 store path 的 NAR 按名称排序拼接成一维字节流,再用 Hilbert 曲线折叠成正方形,从而保持字节局部性,使 store path、文件乃至 ELF section 都对应连续方形区域。布局只需 narinfo 中的 NarSize,因此整张图在下载任何 NAR 前即可毫秒级完成,缩放时再从 cache.nixos.org 按需取 NAR 并按字节类型上色(可打印 ASCII、控制字节、0x00 等)。作者据此验证某争议二进制实际不含 ffmpeg 与 ruby(41 个 path、234 MiB),并展示了 1,324 个 path、5.3 GiB 的 GNOME 桌面 closure,工具支持 nix path-info 导出与额外二进制缓存。其边界是主要用于探索与可视化,不改变 Nix 语义,且读者需具备基本 Nix 背景。

推荐收录:文章给出了明确且可复现的技术机制(Hilbert 曲线字节布局、仅凭 narinfo 提前绘图、缩放时按需拉取 NAR),并用真实 closure(含争议二进制与 GNOME 桌面)验证结论,而非停留在概念演示。适合使用 Nix/NixOS 的开发者、做二进制或依赖体积分析的工程师,以及关注可视化实现的人;其局部性布局与懒加载思路可迁移到其他大体积产物的可视化与审计场景。

工具笔记Alex Chan

Abusing ID3 chapters to turn videos into glanceable podcasts

文章介绍一种把视频转成可在播客应用中扫读的 MP3 的工作流:先用 FFmpeg 提取音轨,并按固定间隔抽帧生成缩略图;再用 Python Mutagen 把每帧作为隐藏的 ID3 CHAP 章节封面写入 MP3。由于 Overcast 支持章节和逐章封面,播放时锁屏或 Now Playing 会以每几秒一帧的慢速定格方式呈现视频画面,从而兼顾音频收听和视觉上下文。作者说明了 CHAP/APIC 帧、FFmpeg fps/scale 滤镜、省略 CTOC 目录以避免数百章节列表等细节,并给出 glancecast 脚本。该方案依赖特定播客应用的章节展示能力,转码速度、竖屏缩放和视觉信息密度也有边界,但作为个人内容消费工具链具有可迁移性。

推荐收录:文章给出了可复现的完整工具链,包括 FFmpeg 抽帧/转码命令、Mutagen 写入 ID3 隐藏章节的代码和验证方式,不是泛泛介绍。适合愿意折腾播客播放器、音视频元数据或自动化工作流的开发者,可迁移到为音频补充视觉上下文、批量生成章节封面等场景;主要风险是强依赖 Overcast 的章节实现,且对需要高保真视频信息的场景不适用。

工具笔记Simon Willison

Generating running routes with GPT-6 Astra and ChatGPT Work

文章记录作者用 ChatGPT Work 与 GPT-6 Astra 生成住所周边 5K/10K 跑步环线的过程:模型运行约 27 分钟,先用 Nominatim 定位地址,再用 Overpass 下载 OpenStreetMap 道路与步道数据,在本地计算环线,最终输出可视化、GPX 和 GeoJSON。地图由 visualize skill 生成内嵌 HTML,用 D3 从允许列表 CDN 加载渲染,并受 CSP 限制。作者的核心批评是 ChatGPT UI 不展示实际执行代码和细节,线程压缩后更无法取回 Python 代码;他建议 LLM 系统在使用压缩时保留压缩前文本,并通过 agent 工具调用暴露给用户。该案例依赖特定模型和产品,代码不可复现,但透明度与上下文压缩问题具有普遍性。

推荐收录:文章用一个可操作案例展示了 LLM agent 调用 OSM 数据生成路线并交付可视化/GPX 的完整工作流,同时指出上下文压缩导致执行细节不可追溯这一工程痛点,并给出保留压缩前文本、通过工具调用暴露的具体改进方向。适合 AI 工程、Agent 平台和开发者工具方向读者参考;局限是缺少可运行代码,细节依赖特定产品,迁移时需自行验证。

工具笔记ClickHouse Engineering

Loading Parquet data into MySQL with ClickHouse

文章介绍如何借助 clickhouse-local 与 ClickHouse 的 mysql 表函数,把 S3 上的 StackOverflow 投票 Parquet 数据直接写入并在 MySQL 中查询,因为 MySQL 本身没有原生导入 Parquet 的方式。作者用 Docker 启动 MySQL 8.4,下载 ClickHouse 二进制,并通过 ch-config.yaml 定义命名集合 mysql_demo 保存连接凭据。核心步骤包括用 DESCRIBE url() 探查 Parquet schema、在 MySQL 建表,再执行 INSERT INTO FUNCTION mysql(...) SELECT ... FROM url() 导入约 230 万行数据。文章重点区分两种查询方式:在 FROM 中写 ClickHouse 子查询时,ClickHouse 会解析并改写成 MySQL 合法 SQL;而通过 query() 传入字符串则原样下发,因此含 tuple 等 ClickHouse 特有函数会直接报错。作者也说明示例为本地演示环境,凭据以明文参数传入,生产系统应改用环境变量。

推荐收录,因为它给出可复现的完整方法,解决 MySQL 无法原生导入 Parquet 的真实数据搬运问题,并明确划出 mysql 表函数的两条边界:ClickHouse 子查询会被改写为 MySQL SQL,而 query() 字符串原样下发,这一区别容易踩坑。适合做 ETL、跨库迁移或用 clickhouse-local 做临时数据处理的工程师参考,命名集合与批量 INSERT 写法可直接迁移;不足是偏操作步骤,性能与生产安全约束讨论有限。

工具笔记Fzakaria Blog

Review a pull request by booting it

文章介绍作者为 trynix 新增的 trynix-preview GitHub Action:它会在 Pull Request 下自动评论一条链接,评审者点击即可在浏览器标签页中启动 Linux 环境,并把该 PR 构建出的二进制加入 PATH,无需 clone、构建、服务器、SSH、Docker 或虚拟机。该 Action 不负责构建与缓存,只通过 nix eval 取出 store 路径,并把缓存地址与公钥交给浏览器,因此前提是目标路径已被构建并推入缓存(如 Cachix)。安全方面需在 fork PR 场景开启 allow-unsafe-pr-checkout,工作流运行于默认分支再检出 PR 代码以防 fork 篡改,并建议为 PR 构建使用隔离的私有缓存。作者也坦承大型二进制执行仍需 1-2 分钟,更适合中小型二进制的评审场景。

推荐收录。该文并非单纯工具发布,而是给出了可复制的工作流配置、缓存前置条件、fork PR 的安全权衡(默认分支运行、隔离私有缓存)以及大二进制启动耗时 1-2 分钟的明确边界。对设计 CI/CD 评审流程、探索浏览器内可执行环境或使用 Nix 的团队有直接可迁移价值。

工具笔记Simon Willison

Introducing wrapture

本文介绍了一款名为 Wrapture 的新 Python 库,由 wrapt、mod_wsgi 的作者 Graham Dumpleton 开发,旨在将 monkeypatching 思想扩展为同时用于测试和追踪。Wrapture 支持包装任意函数或方法,既可以作为 unittest.mock 的替代,也能为现有项目添加配置驱动的 OpenTelemetry 追踪能力。文中给出了配置化追踪 YAML 示例和两个测试模式(stub 返回值与修改原方法的返回值),并强调该项目完全由 AI 辅助编写,但作者明确表示这不是“vibe coding”,而是基于其多年 Python 经验的精心设计。文章指出 Wrapture 仍处于早期阶段,但已具备实用的基础能力。适合对 Python 测试、可观测性以及 AI 辅助编程感兴趣的开发者参考。

推荐收录,因为它不仅介绍了新库的功能与用法,还展示了配置化追踪的设计思路和 AI 辅助工程化的真实案例。对关注 Python 测试工具、可观测性集成或 AI 编程实践的读者具有直接参考价值,其配置驱动模式和测试绑定思路也可迁移到其他语言或项目中。

工具笔记LWN.net

[$] Old-school calendaring at the command line with Remind

文章介绍了 Remind,一款面向 Linux 和 Unix 的命令行日历与闹钟程序,并可选 Tk 图形界面。Remind 拥有自己的脚本语言,能够表达在其他日历工具中难以实现的复杂提醒规则,例如基于日期、周期和条件触发的逻辑。文章详细说明了该脚本语言的核心功能、使用场景和配置方法,并给出了具体示例。作者指出,Remind 不支持日历共享和会议邀请,因此不适合需要团队协作的企业环境,但对偏好命令行的用户来说,它是管理杂乱日程的有效工具。文中还讨论了其与传统日历程序的差异,以及它作为轻量级、快速工具的适用边界。

作为 LWN 的专题文章,它详细介绍了 Remind 及其脚本语言的表达能力,展示了命令行工具在个人日程管理中的独特价值。适合喜欢命令行、注重效率与定制化的用户,以及希望了解非主流但强大的工具设计的开发者。文章虽涉及面较小,但清晰的边界描述和功能展示使其可以作为长期参考。

工具笔记Ben Hoyt

Updating a side project with AI in 275 commits

Ben Hoyt 利用假期约 10 天、通过 275 次提交,将婚礼礼物登记项目 Gifty 扩展为婚礼网站构建器,目标是学习用 AI 工具编写高质量代码。他主要使用 Claude Code 配合 Opus 模型,小任务使用 Pi 与 GLM 模型,采用迭代式开发而非一次性生成,并保留每一步的技术控制。基于已有的 Go 后端、SQLite 和 Htmx 前端,他总结了多条可迁移经验:LLM 注释冗长需持续精简;让代理安装无头浏览器自行截图能改善前端输出,但会大量消耗 token;沙箱内仍可能误删文件,必须运行在容器或虚拟机中;长会话需定期新建并利用上下文压缩。作者估计 AI 将开发时间缩短至原来的三分之一,但也指出测试审查不足、过度依赖 AI 可能让新手跳过必要经验积累。

推荐收录。文章以 275 次提交的真实项目为载体,给出 AI 辅助开发中可复用的工作流证据:迭代式开发、适度代码审查、无头浏览器截图、容器沙箱、会话与上下文管理,并坦诚测试审查不足等边界。适合正在引入 AI 编码工具的后端/全栈开发者,其经验可直接迁移到类似 Web 项目的开发流程中。

工具笔记Simon Willison

Markdown SVG upgrades

文章介绍了一款 Markdown 渲染工具 markdown-svg-renderer 的新功能。该工具允许用户粘贴 Markdown 或通过 URL 加载 Gist,在浏览器中将 SVG 文档渲染成预览,并提供切换至 PNG、JPEG 和 MP4 的标签页。新增加的 MP4 功能会检测 SVG 动画时长、逐帧渲染,并通过 ffmpeg.wasm 在浏览器内将动画导出为视频,以便在不支持 SVG 动画的社交平台分享。文章还给出了具体的 Gist 示例和工具地址,说明了工具的使用场景和易用性。虽然文章没有深入讲解实现源码,但展示了如何用 WebAssembly 将桌面级功能(FFmpeg)搬到浏览器中的思路。

推荐收录。本文虽是一篇个人工具更新日志,但核心亮点在于将 ffmpeg.wasm 集成到浏览器中,实现动画 SVG 转 MP4 的完整流程,这对需要处理 SVG 兼容性的前端开发者、内容创作者和工具作者都有直接参考价值。读者可以从中获得一个轻量、可迁移的解决方案思路;不足之处是技术细节较少,深入实现需参考工具源码。

工具笔记TiDB 社区博客 - 实践案例

平凯 Loop 用户上手指南-详细版 v2.0

文章详细介绍了平凯 Loop 多 Agent 协作开发环境的搭建与使用,涵盖架构概览、Agent 角色设计(架构师、开发者、双审查者、测试、文档工程师等)、Skill 技能库准备、Agent 与 Skill 绑定、频道组织、任务工作流以及需求文档转 Markdown 的多种方式。文中给出了具体的 Agent 系统提示词、配置参数和操作步骤,强调角色分离、交叉审查等实践,并提供了从需求分析、编码、审查到测试、文档的完整示例。文章面向从零搭建多 Agent 开发团队的用户,适用于私有化或 SaaS 部署,但内容高度绑定 Loop 产品,部分建议依赖平凯/TiDB 生态,模型可用性受部署环境限制。

本文提供了可复用的多 Agent 协作开发配置模板,包括角色设计、提示词编写、审查流程和技能绑定,对希望构建 AI 辅助开发工作流的团队有直接借鉴价值。适合正在探索 Agent 协作开发、代码审查自动化或工程效率提升的开发者与技术负责人。主要风险是内容高度绑定平凯 Loop 产品,部分 Skill 和模型建议依赖特定生态,读者需抽取其团队设计思想与工作流模式,而非照搬操作步骤。

工具笔记Simon Willison

alchemy-utils 0.1a0

文章宣布发布 alchemy-utils 0.1a0,这是一个基于 SQLAlchemy 的数据库无关版 sqlite-utils,目标是沿用 sqlite-utils 的核心 API(insert、upsert、insert_all、upsert_all、create、update 和表内省),同时支持 PostgreSQL、SQLite 和 DuckDB。作者通过给 Codex 和 GPT-5.6 Sol Ultra 下达研究性 spike 提示,配合 uv、TDD 和 pytest,在很少的后续提示下获得了可发布的原型。文中展示了用 uvx 列出 PostgreSQL 表数据以及将 CSV 导入 DuckDB 的命令示例,并提到将初始约一小时的 CSV 导入优化到约 35 秒。整体是一篇发布说明,未深入讨论 API 设计权衡、错误处理或扩展性,但提供了 AI 辅助开发数据库工具的具体案例。

推荐收录,因为它记录了一个使用 AI 编程代理快速构建跨数据库 Python 工具的真实过程,并给出了可运行的命令示例,对关注 AI 辅助开发、Python 数据库工具链或 sqlite-utils 生态的读者有直接参考价值。文章虽为 alpha 发布说明,但其中的提示工程思路、uvx 用法和性能优化片段可以迁移到类似项目中。

工具笔记Simon Willison

Moonlight & Mayhem (Raccoon Heist by Codex + GPT-5.6 Sol Ultra)

西蒙·威利森使用 Codex Desktop 的 GPT-5.6 Sol Ultra 模式,用四年前生成的游戏描述作为提示,与之前 Claude Fable 5 的结果进行对比。该模式大量使用子代理,最终生成了一款更符合“盗窃”主题的博物馆解谜游戏,并生成了纹理和提示。但一次性生成的版本存在视觉缺陷:每只浣熊眼睛被放大成巨大球体悬浮在头顶,作者通过后续对话明确现象并修复,相关修复和完整转录均公开在 GitHub。文章还给出了该次会话的 API 成本估算。整体来看,这是对 AI 编码代理实际能力与局限的一次具体案例记录,但其经验主要针对特定模型版本和工具界面,迁移性受限于快速变化的工具生态。

推荐收录,因为文章提供了一个完整的 AI 编码代理实测案例:从生成游戏、发现视觉 bug 到人工介入修复,并公开了代码、转录和成本。适合关注 AI 辅助编程、代码代理工作流或游戏原型快速生成的开发者,能帮助他们理解当前工具的潜力与人工审查的必要性。其可迁移价值在于强调 AI 输出仍需验证,以及如何通过自然语言提示定位问题。

工具笔记Cloudflare Blog

Your agent can now debug Workers with local tracing

Cloudflare为本地Worker开发环境(wrangler dev/vite dev)增加了自动OpenTelemetry追踪捕获功能。系统通过workerd运行时的内置插桩,自动捕捉fetch调用、绑定调用和处理器生命周期等跨度,Miniflare将其集成到SQLite持久对象中,并通过本地浏览器API暴露给编程助手和开发者。作者通过一个数据库模式变更导致500错误的示例展示了追踪如何让助手精确定位失败操作、应用缺失迁移并验证修复,整个迭代无需部署或添加临时日志。文章还简要说明了本地追踪的可视化界面Local Explorer,以及该设计的架构:无需SDK、自动发现、利用本地服务提供结构化反馈。

推荐收录,因为本文不是简单的产品发布,而是详细解释了如何在服务器less运行时中实现零配置的本地追踪,并提供了工程上的设计思路(运行时插桩、本地SQLite存储、API自动发现)。它对使用Cloudflare Workers或类似平台的开发者有直接帮助,同时其‘为编程助手提供结构化调试数据’的模式对提升开发工具链的自动化水平具有启发意义,可迁移至其他本地开发环境的设计中。

工具笔记Simon Willison

uv 0.12.0

文章介绍了 uv 0.12.0 中 uv init 命令的破坏性变化:默认由在根目录生成 main.py 改为使用 src/ 布局,并集成 uv_build 构建后端以支持构建 wheel 和 tar.gz 分发包。作者通过对比 0.11.x 和 0.12.0 的 uv init 输出目录结构,展示了具体差异,并提及已建立自动化快照仓库跟踪变更。作者坦言因惯性尚未在个人项目中采用 src 布局,但认为现在正是切换时机。文章简洁明了,主要面向 Python 开发者,说明工具新版本的默认打包最佳实践,适合新建项目或升级时参考。

推荐收录,因为它记录了 uv 这一重要 Python 工具链中打包默认行为的重大变更,直接提供了前后对比证据,帮助开发者理解社区布局标准化趋势。适合 Python 开发者升级工具或规划新项目结构时参考,可迁移用于改进项目打包配置,避免与新默认行为冲突。

工具笔记Cloudflare Blog

We’re open-sourcing our privacy proxy CLI

Cloudflare 开源了隐私代理 CLI 工具 pvcli,用于简化 Oblivious HTTP (OHTTP) 等隐私保护协议的调试。文章首先说明 OHTTP 涉及客户端、中继、网关和目标四方的多步交互,以及二进制 HTTP 编码和分散的 RFC 带来的调试困难。通过对比手工解析公钥、手动构建加密请求的繁琐过程,作者展示了 pvcli 如何用一条命令自动完成密钥获取、请求加密、二进制解析和日志输出,极大降低开发与事件响应的摩擦。pvcli 设计风格接近 curl,支持 OHTTP 请求、自定义中继头、mTLS 认证等功能,未来计划集成 MASQUE、Privacy Pass 等协议。该工具适合需要端到端测试隐私协议的工程师,能有效提升调试效率并减少人为错误。

本文通过真实的调试痛点,清晰阐述了 pvcli 如何替代手工操作,将 OHTTP 等多方协议调试转化为简洁的命令行流程。文中详细的对比案例和工具设计思路,对从事隐私增强技术、网络代理或协议实施的开发者具有直接参考价值,其工具集成多种协议的方法论也便于迁移到其他类似调试场景。

工具笔记NVIDIA Technical Blog

Debugging Ray Tracing Applications Using NVIDIA OptiX Toolkit

本文介绍了 NVIDIA OptiX Toolkit(OTK)中用于调试光线追踪应用的实用工具,包括 API 验证层、GPU 调试器及性能分析器。文章从常见失败场景(如无效 API 参数、黑帧、GPU 端线程错误)出发,说明如何利用 OTK 暴露的调试功能定位问题,并给出具体使用方法和命令行示例。内容侧重于工程实践中的故障诊断流程,而非纯理论,适合需要快速排查 OptiX 应用错误的开发者。

收录理由:文章提供了可直接操作的 OptiX 调试工作流和工具链,对从事 GPU 光线追踪开发的读者具有明确的可迁移价值;内容来自 NVIDIA 官方技术博客,示例具体,非泛泛介绍。建议新增“Debugging”标签以更精确反映主题。

工具笔记知乎 - 鹅厂架构师

Anthropic内部 Skill 最佳实践

文章摘录并解读了Anthropic内部积累的数百个Skill的实战经验,将Skill系统归纳为九大类型:库与API参考、产品验证、数据获取与分析、业务流程自动化、代码脚手架、代码质量与Review、CI/CD与部署、Runbooks、基础设施运维,并结合作者自身实践指出每种类型的适用场景与价值。同时提炼出九个编写技巧,包括重点记录公司特有的坑点、用文件夹实现渐进式披露、预留灵活性、利用配置与持久化数据、复用脚本、按需安全钩子、通过仓库或插件市场分发、以及统计使用效果以持续优化。文章强调Skill应从少量Gotchas开始逐步完善,并通过实验迭代。内容源自工程一线,适用边界为使用AI编码助手(如Claude Code)的团队或个人,对提升开发效率和自动化常见任务具有直接参考价值。

推荐收录,因为这篇内容来源于真实大型团队的Skill建设实践,提供了系统化的分类框架和可操作的编写技巧,而非空洞的理论。对正在探索AI辅助开发、希望将重复工作自动化的工程师和团队来说,文中分类可直接对照,技巧可直接应用,尤其从‘记录坑点起步’的务实思路降低了落地门槛,长期可迁移价值高。

工具笔记Simon Willison

Using uvx in GitHub Actions in a cache-friendly way

文章分享了一个在 GitHub Actions 中缓存 uvx 工具调用的实用技巧:通过在 workflow 开始处设置 UV_EXCLUDE_NEWER 环境变量并将其作为缓存键的一部分,让 uvx 命令解析到指定日期前的最新工具版本,从而利用 GitHub Actions 缓存避免每次运行都从 PyPI 重复下载。该方法能有效加速 CI 流程、减少对 PyPI 的依赖,适用于需要稳定工具版本的场景,但升级工具需手动更新日期。内容简短,直接给出了可复用的配置片段。

推荐收录,因为它针对开发者常见的 CI 缓存痛点给出了一种低成本、可立即落地的解决方案。技巧虽小,但对使用 uvx 和 GitHub Actions 的 Python 开发者有明确的可迁移价值,能直接降低工作流运行时间和网络波动风险。文章来自有影响力的技术博主,可靠性较高。

工具笔记知乎 - 鹅厂架构师

人人都能懂的科普:你用过安慰剂 skill 吗?

文章围绕“安慰剂 skill”展开,指出很多 AI 工具市场里的 skill 只是把底层大模型本来就会做的事重新包装:通过专家人设、功能清单和示例输出制造出更专业的错觉。作者以图片修复、虚假专家、提示词优化、思维链等几类常见 skill 为例,分析它们为什么看起来有效、实际上往往没有新增能力。文中提出识别方法只有两步:先看 skill 是否包含可执行的规则、边界和触发条件,再把 skill 关掉做对照测试。作者也强调,免费场景下这类包装未必有害,但在付费、健康、法律和财务决策中,安慰剂式提示词可能带来误导风险。

文章直接给出了判断 AI skill 是否“真有用”的可操作方法:看是否有实质规则、再做开关对照实验,而不是只看包装和案例图。适合经常使用或编写提示词、skill 文件的读者参考,尤其对需要区分底模能力与外部增强能力的场景有迁移价值,但在严肃决策领域也提醒了误导风险。

工具笔记Alex Chan

Describing all my photos

文章先提出一个很具体的个人管理策略:作者每周整理相机胶卷,把照片分成保留、删除和“待处理”三类,并进一步要求每张保留照片都写上一两句说明,记录拍摄时的场景和心情。作者认为这种轻量元数据能显著增强照片作为“生活记录”的价值,也能反过来促使自己更谨慎地筛选照片,因为说不清意义的图片未必值得长期保留。随后文章转到工具实现:作者把这一能力加进自写的 Blink Mac 应用,通过快捷键浏览、分类,并用底部覆盖层编辑 caption,保持全程键盘操作。最后作者回顾了重返旧代码库的维护成本,强调注释和文档对长期可读性的重要性,并把这个“只为自己服务”的小软件视为成功案例。文章的边界也很明确:它主要适合个人照片归档和单用户工具,不讨论通用产品化、同步或多用户协作。

文中不仅描述了“给照片写说明”的个人习惯,还给出了可落地的工具设计:键盘优先、轻量编辑、保留上下文元数据,并在自写应用里实现。适合做个人效率工具、桌面软件和长期维护小项目的读者参考,但它的经验强依赖单用户场景,产品化和协作场景的迁移价值有限。

工具笔记Simon Willison

Fable's judgement

文章分享了在 Claude Code/Fable 这类编程代理中减少成本、提升效率的一条实用经验:不要为每个细节预先规定死规则,而是让模型自己判断何时需要测试、何时需要调用更弱的模型或子代理。作者举例说明,像小规模改动、机械性编辑这类任务,可以交给较低功耗的模型在 subagent 中完成;而设计、审计、结果综合等判断密集型工作仍留在主循环中。文中还展示了 Claude Code 将这条指令写入项目 memory 文件,并根据任务性质自动选择 sonnet 或 haiku 级别的模型。作者反馈该策略已经明显延缓了额度消耗,同时保持了工作推进速度。它的适用边界也很清晰:适合以代码编写和编辑为主的任务,不适合把关键决策完全外包给低成本模型。

文中直接给出了可复用的代理协作策略:让模型自行判断是否下沉到子代理、并按任务复杂度选择不同模型,而不是靠人工逐条约束。对使用 Claude Code、编码代理或多模型工作流的读者尤其有参考价值,风险也明确——判断、审计与设计仍必须留在主模型。

工具笔记GitHub Security Lab

6 security settings every GitHub maintainer should enable this week

文章面向 GitHub 维护者,给出一套可在半小时内完成的项目安全基线配置清单,核心是用平台自带能力降低仓库被滥用和泄露的风险。作者依次说明了如何添加 SECURITY.md、开启私密漏洞报告、启用 secret scanning 与 push protection、打开 Dependabot 和 dependency review、启用 CodeQL 代码扫描,以及对默认分支设置分支保护。文章强调这些设置彼此配合:前两项建立负责任披露通道,后几项在提交前或合并前拦截密钥泄漏、易受攻击依赖和常见代码缺陷。结论是它们不能保证“绝对安全”,但能显著关闭被自动化脚本批量利用的低成本入口。局限在于内容高度依赖 GitHub 生态,且更偏安全配置清单而非原理分析。

文中明确给出 6 个可直接开启的 GitHub 安全设置,并解释了 SECURITY.md、PVR、secret scanning、Dependabot、CodeQL 和分支保护各自的拦截点。适合开源维护者和负责仓库治理的工程师快速落地;可迁移价值在于“把安全控制前移到提交与合并环节”,但风险是强依赖 GitHub 平台能力。

工具笔记Simon Willison

Have your agent record video demos of its work with shot-scraper video

本文介绍了 shot-scraper 1.10 新增的 `shot-scraper video` 命令:通过 `storyboard.yml` 定义一组浏览器动作,再借助 Playwright 录制这些步骤的演示视频。作者把它用于 Datasette 的新功能演示,证明这种方式比手工录屏更适合让编码代理自动产出可展示的成果。文章还说明了这套方案如何被 GPT-5.5 xhigh 在 Codex Desktop 中自动生成,包括 YAML 剧本、演示数据库和使用说明。实现过程中遇到的关键问题是 Playwright 早期视频会带调试边框、开头出现白帧,以及录制宽度受限;这些问题分别依赖后续改进和 1.61.0 版本修复才得以落地。作者进一步强调,用命令的 `--help` 输出就能让代理理解并调用工具,这种设计像把技能说明内嵌进 CLI,适合自动化演示、文档生成和代理式工程流程,但更依赖较新的 Playwright 生态。

收录价值明确:文章给出了可复用的“CLI + storyboard + Playwright 录屏”工作流,并展示了编码代理如何直接基于 `--help` 生成可运行的演示脚本。适合做开发工具、自动化文档和 agent 工程的参考,但读者需要注意它依赖较新的 Playwright 版本,且更偏演示录制而非通用测试。

工具笔记知乎 - 鹅厂架构师

Loop Engineering 实践指南:在 CodeBuddy 中构建自主循环系统

文章提出 Loop Engineering 这一面向 AI 编程的“外层循环”设计:不再让人类在每一步介入,而是把目标、验证标准、状态管理和恢复机制外置,由 AI 在受控规则下持续推进任务。作者将 ReAct 视为单任务内的 inner loop,而 Loop Engineering 负责跨任务编排,强调 Discover-Plan-Execute-Verify-Iterate 闭环、对抗验证、断点续跑和多 Agent 并行。全文结合 CodeBuddy 的 /goal、/loop、Automations、Team、Skills、MCP、Rules、Memory 等机制,说明如何把抽象范式落到实际工具链。文中给出迁移、CI 监控、评审协作、知识固化和状态持久化等案例,并提示目标必须可度量、评估器要独立、循环要设置上限。其边界在于高度依赖工具支持,且不能替代人工审查,适合 AI 编程平台设计与智能体工作流实践参考。

收录的直接证据是文章不仅解释了 Loop Engineering 与 ReAct 的层次差异,还给出 /goal、/loop、Team、Skills、MCP、Memory 的具体落地方式和条件写法。适合 AI 编程工具、agent 编排和开发效率优化读者参考;但内容带明显 CodeBuddy 产品色彩,迁移时需注意工具绑定。

工具笔记Simon Willison

Count the number of Safari tabs

这篇短文记录了一个极小但实用的 macOS 技巧:通过 AppleScript 在命令行里统计 Safari 当前打开的全部标签页数量。作者给出的命令是 `osascript -e 'tell application "Safari" to count tabs of every window'`,直接利用 Safari 的脚本接口遍历所有窗口并汇总标签数。文章没有展开 AppleScript 语法或 Safari Automation 的背景,但它清楚展示了一个可复制的自动化片段,适合需要快速盘点浏览器状态、做脚本集成或写小工具的人。其适用范围主要限于 Safari 和支持 AppleScript 的 macOS 环境,对其他浏览器或跨平台场景不直接适用。

有明确可执行命令作为直接证据,能立刻用于 Safari 自动化或状态检查,适合 macOS 开发者和效率工具使用者。局限也很清楚:依赖 Safari 与 AppleScript,迁移到其他浏览器时需要重写。

工具笔记Simon Willison

simonw/browser-compat-db

这篇文章记录了作者把 Mozilla 的 mdn/browser-compat-data 兼容性数据仓库转换成一个约 66MB 的 SQLite 数据库的实践。作者借助 Claude Code 和 sqlite-utils 生成转换脚本,再用 Codex Desktop 编写 GitHub Actions 工作流,在构建后把数据库强制推送到一个独立的 orphan 分支。这样做的目的不是做可写数据库,而是利用普通 GitHub 仓库文件可通过 CDN 访问且带开放 CORS 的特性,方便浏览器端直接下载和在 Datasette Lite 中在线探索。文章的核心价值在于展示了“结构化数据仓库 + SQLite + 静态托管 + 前端可直接查询”的发布链路。它更适合静态、可再生成的数据集分发场景,不适合高频写入或需要事务服务化的系统。

文章给出了可直接复用的证据:SQLite 生成脚本、GitHub Actions 自动构建、orphan 分支静态发布,以及利用 GitHub CDN 的开放 CORS 让浏览器端直接访问。对需要发布可下载数据集、做前端只读查询或搭建轻量数据浏览器的工程实践很有参考价值。

工具笔记Armin Ronacher

The Coming Loop

这篇文章围绕“coding agents 外再套一层 harness loop”的工作方式展开,讨论人们如何用队列、评测器、子代理和持续会话去驱动模型反复迭代。作者一方面肯定这种循环在代码迁移、性能探索、安全扫描和实验自动化中的高效性,另一方面也警惕它在长期维护代码时会放大局部修补、削弱可理解性,并让团队逐步依赖机器来完成判断与解释。文章的核心结论不是简单支持或反对,而是认为循环式自动化会成为未来常态,关键问题转向如何保留人类监督、让系统可理解、并把这种能力约束在可控边界内。

推荐收录,因为它不只是讨论某个工具,而是提炼了 AI 辅助开发正在形成的新工作范式:由模型执行、由外层系统判定、由人类设定边界。文章对哪些任务适合循环、哪些任务不适合、以及这种模式对代码可维护性的影响,都给出了具有迁移价值的判断。

工具笔记Xe Iaso

I hate compilers

这篇文章围绕“把 wasm2js 重新编译成 WebAssembly 以便在项目中做可复现发布”展开,重点不是功能本身,而是作者在构建可复现工具链时遇到的一系列真实问题:__DATE__/__TIME__ 造成非确定性、clang 偷偷调用 PATH 里的旧版 wasm-opt、以及不同架构和 ASLR 导致的指针相关输出差异。作者最终通过禁用自动随机化、关闭链接阶段的 wasm-opt、以及按架构维护校验和与 CI 检查,达成了“同架构内可复现”的目标,但也明确说明跨架构完全一致仍受 LLVM 上游缺陷限制。

推荐收录,因为它提供的是一套可迁移的构建排障思路,而不是单纯的工具报错记录:从非确定性来源识别、工具链污染排查到 CI 里的复现校验,都是长期有用的方法。对做编译器、WASM、打包发布或需要保证产物一致性的工程团队尤其有参考价值。

工具笔记Simon Willison

<click-to-play> — a still that plays

这篇文章介绍了一个名为 <click-to-play> 的 Web Component,用来把“GIF 链接 + 首帧图片”的标记包装成可点击播放的静态预览。其核心思路是先只渲染首帧和播放按钮,等用户主动点击后再按需加载真正的 GIF,从而避免页面首次打开就下载大体积动画。作者强调这是一个 progressive enhancement 方案:即便脚本未运行,原始链接与图片也仍可作为降级内容使用。文章还给出了在 Datasette 示例中的实际应用,说明它适合文档、演示页和大量使用动图说明功能的场景。该方案的边界在于主要面向 GIF 这类重资源媒体,对 Web Components 和 JavaScript 可用性有一定依赖。

文章直接展示了可复用的组件接口、标记结构和按需加载机制,不是单纯的想法分享,适合做前端性能优化与组件封装的参考。对需要在文档、博客或产品页中展示动图但又要控制首屏体积的开发者尤其有用。

工具笔记知乎 - 木鸟杂记

一个大模型从业者的 vibe coding 一些一线经验

这篇文章总结了作者作为大模型从业者在使用 Code Agent 进行 vibe coding 时的若干一线体会,重点讨论了“同步编程”转向“异步驱动 Agent”的工作方式变化。作者围绕决策层级上移、上下文管理、终端式与聊天式工具形态、以及 skill 的创建与迭代,提出了把仓库当作上下文、用文档和日志固化经验、用脚本和示例稳定 Agent 行为等实践原则。文章的结论是:在 Agent 能力快速演进的背景下,真正可长期依赖的仍是软件工程里降低复杂度、约束上下文和明确分层协作的基本方法。

推荐收录,因为它不是泛泛谈“AI 改变编程”,而是从一线协作方式出发,总结了可迁移的 Agent 工作流经验。对于正在把代码助手、自动化代理或技能系统嵌入日常开发的人,这些关于上下文管理、工具形态和职责分层的判断很有参考价值。

工具笔记知乎 - 鹅厂架构师

用模型,讲卫生

这篇文章围绕“如何在 AI 编程/对话式代理中减少 token 消耗”展开,集中分享了作者在 Claude Code、Cursor 等工具里的实操经验。内容涵盖推理档位固定、关闭自适应思考、保持固定前缀以利用缓存、把复杂文档转成 Markdown、缩短会话、精确引用文件/函数、先问后做以及将“思考”和“执行”拆开的工作流。文章的核心结论是:token 焦虑很多时候来自上下文管理不当,而不是模型本身不够聪明;通过约束上下文、减少无效扫描和分工,可以显著提升效率并降低成本,但其中部分配置与工具行为具有平台依赖性。

推荐收录,因为它不是泛泛而谈“怎么用 AI”,而是从上下文、缓存、会话切换、文件引用和任务拆分等角度,给出了可直接迁移到日常 Agent 工作流的省 token 方法。对经常使用 Claude Code、Cursor、ChatGPT/GitHub Copilot 类工具的开发者尤其有参考价值,不过其中部分参数和客户端逻辑会随产品版本变化,需要读者结合实际环境验证。

工具笔记Simon Willison

Publishing WASM wheels to PyPI for use with Pyodide

这篇文章围绕 Pyodide 新增的能力展开:Python 包现在可以像原生平台轮子一样,直接把面向 PyEmscripten 的 WASM wheel 发布到 PyPI,并在运行时安装。作者指出,过去 Pyodide 团队要维护、构建和托管 300 多个包,人工审核成本高,新的分发路径显著降低了社区发布门槛。随后他用自己的 luau-wasm 实验包做了验证:通过 cibuildwheel、GitHub Actions 生成并上传 wheel,再在 Pyodide 中用 micropip 安装后执行 Lua 代码。文中还用 BigQuery 统计了当前带有 pyemscripten_202*_wasm32 标签的 PyPI 包,说明生态已经开始落地但规模仍然有限。文章价值主要在于揭示 WASM Python 包分发链路的变化与实操入口,边界是它更偏发布/工具链更新,而不是深入解释 Pyodide 运行机制。

有明确的直接证据:Pyodide 314.0 已支持把 WASM wheel 直接发布到 PyPI,作者还给出了 luau-wasm 的打包、上传和运行示例。适合需要把 C/C++/Rust 扩展带到浏览器或 Pyodide 环境的维护者参考,但要注意这篇更偏分发工具链更新,生态仍处于早期。

工具笔记Eli Bendersky

Thoughts on starting new projects with LLM agents

这篇文章总结了作者在一个全新 Go 项目中使用 LLM agent 协作开发的实际经验,重点不是“让 AI 代写代码”,而是如何把 agent 纳入可维护、可审查、可迭代的工程流程。作者强调需要先用文档共同设计 API,再按小而可审查的 CL 逐步推进;同时必须保留人工深度 review、持续 refactor 和可靠测试套件,避免把实现与测试都交给 agent 形成自我强化的错误闭环。文章还讨论了为何 Go 特别适合 agent 写作与人类审查,以及这种方式不适合学习全新领域,只适合已经具备判断力的资深工程师用于提效。

推荐收录,因为它提供的是一套可迁移的 LLM 协作开发方法,而不是泛泛的使用感想。文章把设计、代码审查、提交粒度、测试策略和语言可读性串成了完整工作流,对想在真实项目中安全使用 agent 的工程师很有参考价值。

工具笔记知乎 - 腾讯技术工程

如何写好 Skill:一份实战经验手册

这篇文章系统讲解了如何为 AI 编程助手编写 Skill,重点围绕 Skill 的定义、目录结构、SKILL.md 元数据与正文设计、触发准确率优化、Few-Shot 示例、流程图/表格表达、模块化拆分、验证清单以及调试排错方法展开。文章不仅给出可直接复用的模板和 Go 语言示例,还进一步讨论了 MCP 与 HTTP 的适用边界、脚本安全、工程化评估和 Skill Creator 的使用方式,整体目标是把团队经验沉淀为可被 AI 稳定执行的能力包。其适用边界主要在于:内容高度依赖 Claude Code、CodeBuddy 等 Skills 生态,但所讲的方法论对其他 AI 工具同样可迁移。

推荐收录,因为文章不是泛泛介绍概念,而是把“如何写好可执行的 AI Skill”拆成了结构、示例、验证和安全四个层面,具备很强的实操参考价值。它对做 AI 编程助手、团队知识沉淀和自动化工作流建设的读者尤其有用,方法也能迁移到其他提示工程与工具封装场景。

工具笔记知乎 - 鹅厂架构师

当 Agent 写代码比你快,开发者的新瓶颈是什么?

文章讨论了当 AI Agent 能比人类更快写代码之后,开发者的核心瓶颈如何从“写实现”转向“拆任务、定边界、做验证和控 Review”。作者提出一套较完整的 Agentic 开发工作流:用 AGENTS.md 和 justfile 固化项目入口与命令,用 Git Worktree 隔离多个 Workspace,再按 Plan、Prompt、Verify、Review 四步组织多 Agent 并行协作。文章还结合协议先行、质量门禁、自我 Review、浏览器/E2E 验证、以及 Vibe Kanban/HAPI 等工具,说明了如何降低大 diff、环境冲突和幻觉风险,适合作为团队落地 AI 编码协作的实践参考。

推荐收录,因为它不是泛泛谈“AI 提效”,而是把多 Agent 开发拆成了可执行的工程流程,并明确了文档、命令、隔离、验证和 Review 的配套机制。对正在尝试 AI 辅助开发、并行提效或规范 Agent 使用方式的团队,这套方法具有很强的迁移价值。

工具笔记知乎 - NGINX洪志道

我如何用 AI 做真实编程

这篇文章记录了作者用 AI 辅助真实编程的一套实用方法,核心包括优先使用能力更强的大模型、用测试用例约束 AI 输出、频繁重构、以及通过“明确目标—拆小任务—让 AI 实现—自己理解 diff—写/跑测试—继续迭代”的循环推进开发。作者强调代码本身应当成为设计载体,而不是只依赖文档式 SPEC,同时认为真正有价值的经验来自在复杂、真实的任务中持续实践。

推荐收录,因为它给出了一套可直接迁移到日常开发中的 AI 编程工作流,而不是停留在抽象的“怎么问 AI”。其中关于测试、重构、理解 diff 和代码驱动的建议,对使用 AI 提升交付质量和保持代码可维护性都有长期参考价值。

工具笔记Go Blog

Introducing the pkg.go.dev API

本文介绍 Go 官方 pkg.go.dev 新增的程序化访问 API,面向工具、IDE 集成和自动化工作流提供模块与包元数据查询能力。API 采用无状态、仅 GET 的设计,当前以 /v1beta 形式提供,覆盖 package、module、versions、packages、search、symbols、imported-by 和 vulns 等核心端点,并同时发布 OpenAPI 规格。文章强调“precision over convenience”:当同一包路径可能由多个模块提供时,API 不像网页端自动猜测,而是要求客户端显式指定模块,否则返回歧义错误。版本控制支持语义化版本以及 main/master 分支自动解析为 pseudo-version,但不支持任意分支名。文中还给出 pkgsite-cli 参考实现,展示如何在终端搜索、查看符号、列出版本与依赖导入者;其边界是 beta 接口仍可能演进,CLI 也尚未稳定。

这篇文章给出了官方 API 的端点、版本规则、歧义处理和 OpenAPI 规格,属于可直接用于工具集成的实用参考,不是单纯的产品宣传。适合做 Go 生态工具、IDE 插件或自动化脚本的读者借鉴,但需注意当前仍是 v1beta,且参考 CLI 接口并未完全稳定。

工具笔记matklad

TIL: Symlinking NixOS Dotfiles

文章讨论在 NixOS 上管理 dotfiles 的一种轻量替代方案:不使用 home-manager,而是把 dotfiles 与系统配置放在同一仓库中,再通过符号链接把文件放到目标路径。作者指出 NixOS 并没有直接为用户目录提供“原生” symlink 配置,但可以借助 systemd-tmpfiles 的声明式规则间接创建链接,例如把 ~/.config/git/config 指向仓库中的配置文件。文章的核心结论是,这种做法可以兼顾声明式管理和手工可调整性,但作者也明确保留了对其与脚本、stow 等方案优劣的判断空间。

推荐收录,因为它提供了一个具体、可复用的 NixOS 配置技巧,适合正在做 dotfiles 管理或 NixOS 个性化配置的读者。文章价值不在长篇原理,而在于把一个看似没有官方入口的问题,转化为可落地的系统级配置方案。

工具笔记知乎 - 千问云

工作流的 Skill 怎么写?从 7 个顶级 Skill 中提炼的模式与最佳实践

文章围绕“如何编写工作流 Skill”展开,先解释 Skill 的加载机制、SKILL.md 的结构和 frontmatter 的作用,再基于 7 个顶级 Skill 归纳出 5 种核心模式:线性流程、决策树按需加载、循环迭代、接力棒式跨会话持久化、多阶段检查点编排,以及一种偏“控制思维方式”的分析框架。作者进一步总结了让 Skill 更容易被模型遵从的写法,包括强硬语气、明确触发条件、量化阈值、负面指令、安全默认值与人类兜底,并给出最小可用模板和模式选择决策树,便于直接落地到实际 Skill 设计中。

推荐收录,因为它不是泛泛介绍概念,而是从真实顶级 Skill 样本中抽象出可复用的结构模式和写作原则,能直接指导工作流型 Agent/Skill 的设计。对需要为 LLM 编排任务、组织上下文、设计决策流和约束模型行为的工程师来说,这篇文章具有较强的迁移价值和长期参考意义。

工具笔记matklad

Always Be Blaming

这篇文章讨论如何更高效地“读代码”和做代码考古:作者把理解代码分成从预测性阅读、理解当前快照,到追踪历史演化,再到揣摩原作者当时的意图,强调不要只停留在逐行阅读。后半部分重点介绍一种实用的 blame 工作流:借助 GitHub 的历史快照、按行追踪提交、切换到相关 commit,再结合本地自定义快捷键把历史查看“内联化”,以便在保持 LSP、测试和搜索可用的同时快速回到代码的过去版本。文章的边界也很明确,它更像是面向真实开发场景的个人工作流总结,而不是通用的 Git 教程。

推荐收录,因为它把“读代码”从静态理解提升到基于版本历史的系统化方法,并给出了可直接迁移到日常开发中的操作流程。对经常需要定位历史原因、理解遗留代码或做 bug 溯源的工程师来说,这类工作流有很强的长期参考价值。

工具笔记知乎 - 哔哩哔哩技术

bili-fe-workflow —商业化智能开发工作流实践

这篇文章系统介绍了哔哩哔哩前端团队围绕 AI 辅助开发搭建的商业化智能开发工作流实践,重点包括 `.workflow` 项目知识库、`prd-preprocess` 需求预处理、智能开发工作流中的 D2C/Dev 分流,以及测试工作流和 AI Mock 工作流。作者不是停留在“用 AI 写代码”的表层,而是把需求澄清、知识沉淀、上下文编排、子代理协作、增量更新和测试闭环串成了一套可执行的工程体系,并明确了它对 Claude Code、MCP、Figma 等生态的依赖与适用边界。

推荐收录,因为文章展示的不是单点提效技巧,而是一套可迁移的 AI 开发工作流设计方法,覆盖从 PRD 预处理到代码生成、测试、Mock、归档的完整链路。对正在探索 AI 编程落地、希望把经验沉淀为团队规范和可复用资产的工程团队,尤其有参考价值。

工具笔记matklad

Catch Flakes On Main

文章提出一个很实用的工程习惯:即使使用 merge queue 或类似机制,也要在 main 分支上持续冗余地跑完整测试套件,并维护一个随手可查的近期 main 失败列表。作者强调,只有当 main 被强约束为“理论上应始终通过”时,主干上的失败才更容易被识别为 flaky test,从而集中治理最影响效率的不稳定来源。文章还指出,积累这类失败记录不仅能帮助优先级排序,还能揭示不同故障之间的相关性。

推荐收录,因为它把“如何识别和治理 flaky tests”总结成了一个可直接落地的工作流,而不是泛泛而谈测试质量。对于有 CI/CD、合并队列或大规模测试体系的团队,这个习惯具有很强的迁移价值,能持续降低无效重跑和排障成本。

工具笔记知乎 - 孔某人

AI Coding的软件工程(1)如何实现复利

文章讨论 AI Coding 时代软件工程实践如何形成“复利”,核心观点是:不要把 Coding Agent 当成需要不断手工修补的工具,而应把它看作一种新的“编译器”。作者提出应明确区分人工强干预的“干预边界”和交给 AI 执行的“High-level Spec”层,尽量通过规范化文档、设计约束和重复指令沉淀来复用,而不是事后逐步编辑生成结果。文章还指出 AI Coding 在熟悉领域、高质量代码、强可靠性场景中收益会下降,边界不清时越容易陷入重复干预和低效协作。

推荐收录,因为它不是泛泛讨论“AI 写代码很快”,而是给出了一个可迁移的软件工程视角:把 AI Coding 的问题建模成编译与接口设计,而不是单次生成与修补。对正在使用 Coding Agent 的开发者、团队和工具实践者,这篇文章能帮助他们重新划分人机协作边界,减少无效干预。

工具笔记matklad

Steering Zig Fmt

文章围绕 Zig 的代码格式化工具 zig fmt,分享了两条实用经验:一是可以通过尾随逗号等语法细节“引导”格式化结果,而不是完全依赖格式化器猜测作者意图;二是数组字面量的首个换行位置会影响列式排版,从而可以控制每行容纳多少元素。作者进一步说明,这种可控的格式化方式适合在保持统一风格的同时保留少量人为布局选择,尤其适用于参数列表、命令行 argv 构造等场景。文章也隐含了一个更广泛的观点:优秀的格式化器设计不应只追求唯一答案,而应允许语法信号参与布局决策。

推荐收录,因为它不是单纯的工具使用小技巧,而是揭示了格式化器如何与代码结构协同工作的设计思路。对 Zig 使用者、编程语言工具链开发者以及代码格式化器实现者都有可迁移价值。

工具笔记知乎 - 千问云

浏览器自动化:从GUI到OpenCLI

文章讨论了浏览器自动化从“直接操控GUI”转向“解析并复现底层API请求”的方法,核心目标是提升自动化的稳定性、效率和可维护性。作者进一步提出了 OpenCLI 的工作流:通过浏览器观察、网络抓包、鉴权策略分层和适配器生成,把网站能力包装成可调用的 CLI,并明确指出了当前对写操作、请求体捕获等场景的局限。文章最后延伸到“面向 Agent 的可调用性”这一判断,认为未来软件的重要竞争点之一将是是否容易被自动化系统稳定调用。

推荐收录,因为它不仅讲了一个具体工具,还总结了从 UI 自动化转向 API 自动化的可迁移方法,特别适合做开发工具、Agent 工程和浏览器自动化的参考。文章同时给出了认证分层、探索流程和局限边界,具有较强的实践指导意义,而不是停留在概念宣传。

工具笔记知乎 - 鹅厂架构师

AI 能记住全世界,凭什么不能记住你自己?| AI 时代如何搭建「个人知识库」

文章讨论 AI 时代个人知识管理的变化,核心观点是:知识不再主要靠手工整理,而是在与 AI 的高质量对话、项目协作和动手实践中自然产生,因此需要一层属于个人的“编译层”来统一沉淀、关联和检索。作者详细介绍了自己搭建的 KnowledgeVault 方案,包括 raw/compiled/explored 三层目录、Compile/Explore/Lint/Export 四种使用模式,以及“只记录不判断”“Profile 只传 context 不传 constraint”“防止 LLM 把多源信息编顺”等关键设计取舍。文章最终强调,这套方法不依赖 Claude 生态本身,适用于任何能够持续沉淀结构化产出、并支持跨文件/跨项目操作的 AI 工作流。

推荐收录,因为它不是泛泛谈“如何做笔记”,而是给出了一个可落地的个人 AI 知识系统架构,并明确解释了分层、编译、校验和检索之间的边界。对于深度使用 AI 的开发者、架构师和知识工作者,这篇文章提供了可迁移的工作流设计思路,以及防止知识漂移和叙事锁定的具体方法。

工具笔记知乎 - SmartCode 得物技术

基于 Harness + SDD + 多仓管理模式的 AI 全栈开发实践|得物技术

文章总结了一套面向全栈开发的 AI 协作方法:用 Harness 思维给 AI 提供现有实现作为约束,结合 SDD 将前后端需求拆成可对齐的设计文档,再借助 Cursor/Claude Code 的多 Agent 能力并行生成代码。作者还详细说明了多仓工作区、代码索引、Mock 验证、后端编译校验和分阶段联调的流程,并提醒要警惕 AI 在模仿参考实现时自动带入隐性逻辑。文中结论是:当上下文、约束和验证链路足够完整时,AI 全栈开发的采纳率和交付效率会显著提升,但前提是接口契约、字段映射和隐性行为必须被主动审查。

推荐收录,因为它不是泛泛介绍 AI 编程工具,而是给出了一套能落地的全栈工作流:如何约束生成、如何组织上下文、如何拆分 SDD、如何并行开发与验证。对正在使用 Cursor、Claude Code 或类似工具做全栈协作的工程团队,这篇文章具有很强的可迁移性和实操参考价值。

工具笔记Eugene Yan

How to Work and Compound with AI

文章总结作者与 AI 协作并让成果持续复利的方法。核心是把上下文当基础设施:整理目录树、维护 INDEX.md、用 CLAUDE.md 让每个新会话像新人入职,并分层保存事实与偏好。其次把品味编码为配置,按全局/仓库/项目分层,把高频流程做成按需加载的 skills,并在会话中纠正以迭代技能。验证上主张检查左移,用钩子、测试、eval、浏览器检查等低成本反馈推动自主执行,长任务用次级会话监督漂移。规模化委派强调先定义成功标准再交付大任务,并行多会话并用 worktree 与状态提示保持可观测;最后通过公开工作、挖掘会话记录更新配置、定期重构来闭环。作者认为具体工具会变,但这些原则也适用于 agent harness、团队规范与组织基础设施。

推荐收录。文章给出了可直接操作和迁移的 AI 协作工作流:CLAUDE.md 分层、skills 生成与迭代、验证阶梯、并行委派、transcript 挖掘和定期重构,并附有具体示例与机制说明。适合使用 Claude Code/LLM 的工程师、AI 工程团队和关注开发者生产力的读者,可用来设计 agent harness、团队规范或组织上下文基础设施。风险是具体工具与配置会随模型演进快速过时,但底层原则仍长期有效。

工具笔记Go Blog

Using go fix to modernize Go code

本文介绍 Go 1.26 中重写后的 go fix:它可按包模式批量应用现代化修复,支持 -diff 预览、按分析器选择性启用,并会跳过生成文件与不匹配的构建配置。作者用 minmax、rangeint、stringscut 和 newexpr 等例子说明,go fix 不只是修 bug,更是在把旧写法迁移到更新的语言/标准库习惯上,甚至能跨包替换“new-like”辅助函数。文章进一步解释了 go vet 与 go fix 统一到 Go analysis framework 后的架构:分析器、驱动、事实传递、gopls/staticcheck 等复用同一套基础设施。它也强调多次运行可产生协同修复,但仍可能出现语义冲突、未使用变量或需要手工处理的边界。最后提出“self-service”静态分析设想,希望未来能让第三方 API 和组织规则也像标准库现代化一样自动推广。

推荐收录,因为文章直接给出了 go fix 的使用方式、分析器机制和典型修复案例,证据充分且不是产品宣传。适合 Go 开发者、工具链维护者和静态分析作者阅读,其中关于批量重构、安全修复与分析框架复用的经验具有较强迁移价值。

工具笔记Anthropic Engineering

Equipping agents for the real world with Agent Skills

文章介绍 Anthropic 提出的 Agent Skills:一种把领域知识打包成目录的标准,核心由 SKILL.md、可选的附加文档和脚本组成,供代理按需发现与加载。作者强调“渐进式披露”是关键设计:启动时只读元数据,需要时再读取正文和相关文件,从而在文件系统和代码执行工具支持下突破单一上下文窗口限制。文中还说明技能可直接调用确定性脚本完成适合代码处理的任务,并给出从评估缺口、拆分结构、观察代理行为到迭代优化的构建方法。最后专门提醒技能可能引入供应链和数据外泄风险,建议只安装可信来源并审查依赖与外部网络访问。整体更像一份面向代理工程的可复用规范与实践指南,而不是单纯产品宣发。

文章直接给出了 Agent Skills 的目录结构、加载机制、代码执行方式和安全注意事项,属于可落地的代理工程方法总结,而非泛泛概念介绍。适合正在构建 Claude 生态、Agent 工作流或可移植提示/脚本封装方案的读者,具有较强的迁移价值,但需要注意其内容与 Anthropic 生态绑定较强。

工具笔记Go Blog

Flight Recorder in Go 1.25

文章介绍了 Go 1.25 新增的 flight recorder:它基于执行 trace,但不再把全量数据写到文件或 socket,而是将最近几秒的 trace 缓存在内存中,等程序检测到故障时再一次性导出。作者给出 `MinAge`、`MaxBytes`、`Start/Stop` 与 `WriteTo` 的使用方式,并说明该机制特别适合长时间运行的 Web 服务。文中以一个 HTTP “猜数字”服务为例,展示如何在请求耗时超过 100ms 时触发快照,再用 `go tool trace` 查看时间线和 flow event。最终定位到 `sendReport` 中 `defer Unlock` 让锁持有时间被意外拉长,导致偶发长尾延迟。文章也明确了适用边界:它不是全量追踪方案,仍需合理控制内存预算和触发条件。

文中直接给出 flight recorder 的 API、配置参数、快照导出和 trace 分析流程,并用真实并发性能问题证明其定位价值。适合维护 Go 长运行服务、排查线上延迟和锁竞争的工程师,迁移价值在于“先留最近窗口、再按异常触发取证”的诊断思路。

工具笔记Anthropic Engineering

Desktop Extensions: One-click MCP server installation for Claude Desktop

文章介绍 Claude Desktop Extensions(MCPB)这一新的本地 MCP 服务器打包与安装格式,核心目标是把原先依赖 Node/Python、手动改配置和处理依赖冲突的安装流程,简化为下载 .mcpb 后在 Claude Desktop 中一键安装。作者说明了 MCPB 以 zip 形式封装 server、manifest、依赖和图标,manifest 负责描述元数据、运行时、工具/提示词、平台差异和用户配置,并支持模板变量与敏感信息存入系统密钥链。文章还给出 mcpb init/pack 的实践路径,以及跨平台、自动更新、目录浏览、企业预装/黑名单/MDM 等能力。它的价值在于为本地 AI 工具分发提供了可复用的规范,但当前版本仍是 0.1,具体字段和 Claude Desktop 实现预计会继续演进。

建议收录:正文明确给出了 .mcpb 打包格式、manifest 结构、模板变量、用户配置和企业管控等关键机制,不只是产品发布。适合做 MCP 服务器开发、桌面 AI 工具分发和安全安装设计的参考,但需注意规范仍处于 0.1 版本,后续可能演进。

工具笔记Brendan Gregg

Doom GPU Flame Graphs

文章介绍了 Brendan Gregg 团队开源的 AI Flame Graphs 新能力:在 Intel Battlemage GPU 上生成完整的 GPU flame graph,并与 FlameScope 结合做 CPU/GPU 的亚秒级可视化分析。作者用 GZDoom 作为案例,通过自制的高负载地图把不同房间的渲染、后处理、stencil 和 sprite 开销拆开观察,并用 GPU flame scope 定位到具体时间窗口。文中还展示了 CPU 端的 shader 编译与 NIR 预处理如何对应到 GPU 空转区间,说明这种图形化方法能快速建立跨 CPU/GPU 的因果关联。与此同时,文章明确列出使用门槛:需要 Linux root 权限、较新的内核与显卡驱动、启用 eustalls/eudebug 接口,以及带 frame pointers 的系统库和应用。它的适用边界也很清楚:当前主要面向 Intel 硬件与 Linux,且采样开销、驱动支持和环境准备仍在完善中。

推荐收录,因为文章给出了可操作的 GPU 性能剖析方法、命令示例和完整环境要求,而不是停留在概念介绍。适合做图形渲染、GPU profiling 和性能诊断参考,但当前局限于 Intel/Linux 生态,部署门槛较高。

工具笔记Brendan Gregg

AI Flame Graphs

这篇文章介绍了 Intel 正在试验的 AI Flame Graphs:把传统 CPU flame graph 扩展到 GPU/AI 加速器,统一展示加速器指令、源代码和触发它们的 CPU 调用链。作者强调其核心目标是像 CPU 性能分析那样做到低开销、生产安全、随时可用,并通过 EU stall profiling 与 eBPF 结合,定位 AI 工作负载中的热点和停顿原因。文中还展示了 SYCL 矩阵乘和 PyTorch/Llama 2 的示例,说明它能把看似混乱的 AI 栈收敛到少数关键瓶颈函数或指令。作者同时指出当前仍处于早期阶段,PyTorch、符号化、驱动和运行时适配都较困难,部分场景还有中等开销,离大规模通用化还需要较长时间。

推荐收录,因为文中明确给出了新型 AI 性能分析工具的设计目标、实现思路和适用边界,而不是停留在产品宣传层面。适合做 GPU/AI 性能优化、可观测性和开发工具演进的参考,尤其对需要把加速器热点与上层代码关联起来的工程团队有直接迁移价值。