排序
让 AI 真正懂你:打造个人化的本地编程助手
用 AI 写代码快一年了,从最初的新鲜感,到现在越来越觉得:工具本身差不多,关键在于你怎么用它。 prompt 写得好不好,决定了 AI 给你的答案质量。我见过很多人抱怨 AI 不听话,给了上下文还是...
GitHub Actions cache 三个真实坑:restore-keys 软匹配、容量上限、lookup-only 陷阱
问题现象 GitHub Actions 跑了三个月,cache 命中率始终在 30% 徘徊。明明每次只改了一行代码,却每次都重新下载 400MB 的 node_modules。直到加了 restore-keys,命中率也没见涨。 restore-key...
本地 LLM 部署:三个省 token 的实战技巧
本地跑大模型,context window 不够用是个老问题了。我自己的 8B 模型实际能用的 context 大概只有 8192 tokens,多了就开始胡言乱语,试过不少方法才摸清楚哪些真正有效。 这篇文章三个技巧都...
上下文压缩后缓存失效:RAG 系统的真实踩坑与解法
上下文压缩后缓存失效:RAG 系统的真实踩坑与解法 用 RAG(检索增强生成)跑生产系统,最怕两件事:上下文超限,和明明压缩了却没省下 token。第二个问题更隐蔽——你上了上下文压缩,LLM 输入...
GitHub Actions 矩阵构建避坑指南:多平台多版本并行测试的 5 个真实问题
解决什么问题 GitHub Actions 的 matrix 策略让你可以用一条 workflow 跑遍 Python 3.9/3.10/3.11/3.12 四个版本 + macOS/Linux/Windows 三个系统。但真正用过的人都知道:matrix 跑起来很爽,...
GitHub Actions fail-fast 陷阱:我的矩阵任务被团灭始末
问题场景:12 个矩阵任务被「团灭」 用矩阵策略跑 12 个测试组合,一个组合失败了,另外 11 个正在运行的任务全部被 GitHub Actions 强制取消,白跑了 40 分钟。 这不是网络波动,是 fail-fast ...
LLM 上下文窗口溢出维修实录:3个真实踩坑案例与工程解法
问题:上下文窗口不是无限的 上线客服机器人三个月后,用户开始反馈'答非所问'。查日志发现单会话 token 数已经突破 18 万——上下文窗口爆了,最关键的用户订单信息被截断在最前面,模型根本'...
GitHub Actions 实战:生产级 CI/CD 流水线搭建全过程
GitHub Actions 实战:生产级 CI/CD 流水线搭建全过程很多团队想上 CI/CD,但被 GitLab CI、Jenkins、GitHub Actions 这么多选择搞晕了。这篇直接说清楚我的判断:*如果你的代码在 GitHub 上,...
HyDE实战:RAG召回率从0.42到0.78的完整记录
解决什么问题 RAG 问答系统里,模型够强但检索层召回率太低——向量检索拿不到正确答案的上下文,模型 hallucinate。客服场景下'工单'vs'订单'语义相似度仅 0.05,直接检索返回错误段落。HyDE(...
GitHub Actions pip 缓存总失效?我踩过最深的 4 个坑
# GitHub Actions pip 缓存总失效?我踩过最深的 4 个坑 GitHub Actions 的 pip 缓存用不对,每次 CI 都重新下载几千个包,多花 1-3 分钟。本文记录我实际踩过的 4 个缓存失效场景,给出可直接...
Claude Code CLI:AI 编程的新一代利器
过去一年,各种 AI 编程工具层出不穷。Copilot、Cursor、通义灵码……IDE 插件装了一圈,用久了总觉得差点意思——要么太被动,等你敲完才补全;要么太封闭,换个编辑器就失灵。直到我碰上 Clau...
GitHub Actions 里 Docker BuildKit 缓存每次失效的根因:type=registry 的 token 过期问题
问题:明明没改代码,缓存却每次都失效 你在 GitHub Actions 里配了 Docker BuildKit 的 type=registry 缓存,本地跑好好的,Actions 里却每次都从零编译。查看日志,cache source is untrusted...











