博客
原创内容,六条主线:AI 产品方法论 · AI Coding 实践 · 第二大脑 · 算力基础设施 · 真实项目复盘。按时间倒序。
2026 年 9 月
观澜复盘:一个人 + 一队 Agent,怎么做出聚合 560+ 信源的 AI 态势看板
从"信息过载"这个真痛点出发,讲清观澜的定位取舍、信源聚合与事件聚类的难点、每小时视频播报的自动化链路,以及为什么把整套系统跑在自己的 NAS 上。
2026-09-18 · 产品复盘AI Coding 重塑产品经理工作流:从写 PRD 到写 Prompt
产品经理的核心产出正在从"文档"变成"意图的精确表达"。半年实践的诚实记录:哪些环节真的被重塑了,哪些只是伪效率。
2026-09-15 · AI Coding推理"慢"的三层真相:解耦归因才能救性能
解码速度的硬件天花板、首次延迟的编译开销、思维链的 token 消耗——"慢"是三个问题的总称。解耦归因后,27 倍提速来自一个请求参数。
2026-09-14 · 性能优化第二大脑的工程化:把"记住"变成"可检索的知识库"
把记忆系统当产品做:写入规范、去重合并、受控词表、召回验证,以及从论文里学到的"擅长保留、弱于修正"这个核心瓶颈。
2026-09-12 · 方法论前缀缓存调优被静默回滚之后:托管平台上的配置治理
两行配置换来体验翻倍,被平台自动更新静默覆盖,备份也一并消失。托管平台配置治理三条纪律:更新后核查、外置持久化、变更清单化。
2026-09-11 · 配置治理产品经理与 Agent 的协作边界:什么该交出去,什么必须自己留
一份我实际在用的分工清单:意图定义、品味判断、验收标准必须自己留;草稿、代码、调研大胆交出去。附踩坑案例。
2026-09-09 · AI 协作从大厂到 AI 产品:一次产品经理转型的真实记录
离开成熟业务体系跳进 AI 湍流:哪些大厂方法论仍然锋利,哪些已经钝掉,什么能力需要从头再建。
2026-09-05 · 职业思考个人知识系统踩坑实录:从收藏夹吃灰到知识可复用
Notion、Obsidian、flomo 都试过,问题不在工具,在"存"和"用"之间缺的那条流水线。交过的学费和最终跑通的方案。
2026-09-01 · 方法论2026 年 8 月
记忆系统的失败模式学:从一份基准评测说起
八种典型失败模式逐条自查:编码缺失、弱于修正、形式错配、冲突不处理、领域错配召回、冗余碎片化、检索对齐失败、丢失推理链。
2026-08-28 · 第二大脑双机分布式 vLLM 部署实录:启动顺序的竞态陷阱
rank 启动顺序竞态、master 端口占用导致通信层连锁崩溃、worker 被内核静默击杀、推理预算耗尽返回空内容——四个坑与一份操作手册。
2026-08-30 · 大模型部署给记忆立规矩:一套可执行的写入卫生学
写前必检索、权威条目合并、受控词表、空间隔离、冲突状态机——五条可直接落地的写入纪律,每条背后都是一次真实的教训。
2026-08-24 · 第二大脑Layer 0:动手写代码之前,先画一张控制图
集成外部系统前的建模纪律:被控对象、观测指标、扰动分类、控制律。以及"框架当装饰"这种最昂贵的自我安慰。
2026-08-20 · 系统工程静默降级:AI 系统里最危险的失败模式
配置里的模型不是跑着的模型。三种假象(配置假象、日志假象、抽查假象)与探针设计的三个原则:信探针、降级必须显式、产出留痕。
2026-08-16 · 可靠性OOM 的四张面孔:推理容器显存事故全记录
加载策略型、队列旁路型、碎片累积型、进程内泄漏型——四类显存耗尽的触发链与防御。核心结论:显存预算必须有唯一的记账人。
2026-08-13 · 故障复盘产品经理的情报系统:业务与技术双轨设计
两类信息的节奏、生命周期、评分标准完全不同。双轨怎么分、怎么共用基础设施,以及核心认知:情报分级就是注意力管理。
2026-08-12 · 情报系统4090 对阵 Jetson Thor:一次控制变量的出图基准测试
同提示词同种子,512 分辨率持平,1024 相差 3.5 倍,步数完全不敏感暴露了瓶颈位置。基准测试最好的输出是角色分配,不是排名。
2026-08-09 · 基准测试AI 内容工厂的六个质量闸门
选题、生成、污染防御、审核、合规、发布——每个闸门拦什么、怎么拦、失效了会怎样。重点:警惕"AI 审 AI"的回音壁。
2026-08-08 · AI 内容把生产环境跑在家里:自部署的产品思考
自部署与否是可以理性计算的决策。成本结构分析、分层分发架构、自愈设计的三个层次,以及四种不该自部署的情况。
2026-08-04 · 架构2026 年 7 月
推理服务的变慢排查实录:缓存、配置与漂移
首字延迟飙升、缓存命中率消失、配置被静默回滚。完整排查链与方法论沉淀:配置即假设,系统当前状态必须永远可审计。
2026-07-31 · 可靠性专家访谈的方法论:从提纲设计到口径校准
什么问题值得访谈、四维度提纲设计、多位专家口径不一致怎么处理,以及一个反直觉提醒:专家对未来的发言要打折。
2026-07-27 · 研究方法API 集成的防御性设计:从两次线上事故说起
本地路径传成 400、死循环重试烧穿队列。契约显式化、失败分类、资源预检、退避与上限——以及防御预算该花在哪。
2026-07-23 · 集成设计个人 AI 算力集群演进记:设备分工的三次重构
从一台机器打天下,到四节点各司其职:生图主力、推理仓、素材库、Agent 运行时。三次重构的动因、设备取消的尴尬与"买回"的教训。
2026-07-19 · 架构演进内存互斥教我的事:算力节点"一机一事"原则
两个服务因内存互斥无法共存。资源互斥的服务不共机;必须共机时,显式声明预算与启停顺序。用利用率损失买稳定性确定性。
2026-07-15 · 架构原则本地跑大模型还是走云端 API:我的一年级决策框架
一年换三次立场,最后沉淀为路由框架:成本、隐私、延迟、可控性、运维负担五个维度逐任务打分,路由表自己长出来。
2026-07-11 · 决策框架