Thoughts on AI, technology, and innovation
把任务的身份证从「一行文本」改成「UUID + frontmatter + 只追加执行记录」,顺手让 AI Agent 能直接认领任务——Task Vault 的数据模型设计与 4 个非显而易见的工程决策。
FFmpeg 的 filter_complex 看起来像管道,但标签只能消费一次;loudnorm 看起来有默认值,但 -16 和 -14 是两种分发策略;amix 看起来在混音,但 normalize=1 会偷偷把语音衰减 -6dB。本文从 OpenMontage 的三个修复拆解这些坑,并给出生产级 AI 视频管线该怎么做。
OpenMontage 的 chromakey 绿幕处理器一度把每一帧画面压缩成单个像素——根因是 FFmpeg overlay 取第一个输入尺寸的隐式行为,加上 scale=iw:ih 的静默空操作。本文逐层拆解这两个 bug,并解释为什么 yuva420p 格式声明是跨 FFmpeg 构建保住透明度的关键。
自建 AI Agent 后,cron 任务的结果怎么实时推到手机?本文从架构、客户端覆盖、安全模型、延迟、附件、消息历史七个维度拆解 ntfy、Gotify、Nostr Relay 三种方案,实测数据标注时间,结论明确:AI Agent 推送选 ntfy,纯 Android 选 Gotify,去中心化信仰选 Nostr。
bitchat 的白皮书说它用「受控泛洪」,源码里真正省下空口时间的却是按邻居数放宽的抖动窗口;它的同步滤波器直接借用了 Bitcoin 的 BIP-158;而它的身份模型是撕裂的——Nostr 侧每个 geohash 换一个不可关联的公钥,BLE 侧却在广播一个永不轮换的 8 字节指纹。本文从代码层拆开这三件事,并对照 Briar、Meshtastic、Bridgefy 说明哪些设计值得抄、哪些不值得。
diagram-design 用 27 个 Markdown 规范文件让模型手写 SVG 坐标。它把配色、字体、可访问性、供应链全都做成了 CI 强制门,却对自己称为「不可协商」的五条几何规则一行校验都没写——这恰好划出了 agent skill 里可验与不可验的边界。
stablyai/orca 用五个月做到 43,205 star、8,490 次提交,代码主要由 agent 集群写成。读完源码后我认为最值得抄的不是功能,而是它把工程纪律编译成机器闸门的方式:行数棘轮只准缩、74 条可靠性闸门要浸泡 100 次才能晋升、换一个 socket 文件名要走七步协议——因为旧方案经七轮评审产生过二十三个缺陷。
2026 年 6 月 15 日,n0 发布了 iroh 1.0——这个用 Rust 编写的网络栈让你用设备的公钥而非 IP 地址来发起连接,迎来首个稳定版本。本文深入剖析 iroh 如何穿透 NAT 打洞、如何在打洞失败时回落到中继、为何要自研 QUIC 实现,以及它如何把整个互联网变成一个安全的 localhost。我们将拆解它的架构、可组合协议生态、全新的官方 Python/Node/Swift/Kotlin 绑定,以及 1.0 的线协议稳定性承诺对生产环境到底意味着什么。
深入解析线束工程——每辆汽车、每架飞机、每台工业机器的神经系统背后的工程学。覆盖 Yazaki、TE Connectivity 等八大龙头企业,IPC/WHMA-A-620、USCAR 等关键标准,现代设计工具与自动化趋势。
切斯特顿栅栏是一个思维模型,告诫我们在拆除任何东西之前,先弄清楚它为什么存在。这个源自 G.K. 切斯特顿 1929 年寓言的原理,已成为软件工程、组织设计和公共政策中二阶思维的基石。
多角度评测 code-simplifier 技能生态,对比 Anthropic Claude Code 官方插件与我们适配的 Hermes 版本。深入分析安全简化的五项原则,用真实代码模式测试两个实现,明确哪些值得借鉴、哪些已经覆盖。
深入评测 webapp-testing 技能,对比我们基于 Playwright 的方案与 AI agent 生态中的替代工具。分析侦查-执行模式、服务器生命周期管理,以及为什么大多数 AI 测试工具把事情搞复杂了。
对 GitNexus 的全面技术分析——这个拥有 35K GitHub Star 的零服务器代码智能引擎。我们深入剖析其 12 阶段索引流水线、16 个 MCP 工具、流程检测引擎、LadybugDB 图存储,并评估其在我们 AI Agent 技能生态中的适配性。
tmux 控制技能在 skills.sh 上有 2800 个安装量,但你的 AI 智能体真的需要它吗?我们探讨了基于 tmux 的会话控制与原生终端工具之间的架构权衡。
同步让 AI Agent 在多台机器上保持一致,但无法拯救宕机的服务器或误删的文件。深入分析为什么备份是同步之后的自然下一步,以及如何用每日 ZIP + git push 策略补齐这块短板。
深入分析如何评估和整合 SkyworkAI 开源 Office Skills 到 Hermes Skill Graph 2.0 体系——安全审计、多维评估、架构决策,以及完整的适配过程。
Skill Graphs 2.0 是一套将 AI Agent 技能组织为原子、分子、化合物的层级架构方法论——把扁平的工具箱转化为可组合、可版本化的知识图谱。本文分享设计思路、来自 194 个技能的实战指标和架构经验。
Spark 2.0 为 3D 高斯溅射引入了流式 LOD 和虚拟分页系统,让包含上亿溅射体的场景在任何设备上流畅渲染。由李飞飞的 World Labs 打造,它重新定义了 3DGS 内容在开放网络上的呈现方式。
当你在 MacBook、Linux 工作站和云服务器上使用同一个 AI 编程助手时,技能如何保持一致?系统对比 Hermes、Claude Code、Cursor、Copilot、OpenCode、Aider 和 Windsurf 八大生态的同步策略,以及从 dotfiles 到 Nix 的六种通用方案。
我扫描了 0xNyk 的 awesome-hermes-agent 列表(2,197 stars),从 7 个仓库中找出 11 个可安装技能,批量安装了其中 10 个,诊断了每一个损坏的依赖项,并修复了平台兼容性问题。这是完整记录。