排序
LLM 上下文窗口快满了?我在生产踩过的3种应对方案与坑
上下文越来越长,模型却开始答非所问 用 LLM 做应用开发,最怕的不是模型不够聪明,而是上下文窗口越来越不够用。 我接手过一个客服机器人项目,上线第一个月效果很好。第三个月开始,用户频繁...
Docker BuildKit 缓存失效的 5 个真实场景:GitHub Actions CI/CD 提速避坑指南
Docker BuildKit 缓存失效的 5 个真实场景:GitHub Actions CI/CD 提速避坑指南 明明什么都没改,GitHub Actions 的 Docker 镜像构建每次都从零开始。层缓存失效是 CI 慢的根因,但 BuildKit 在...
RAG 上下文压缩后缓存失效的根因与三个解法
# RAG 上下文压缩后缓存失效的根因与三个解法 用 RAG 跑生产环境时,上下文压缩(Context Compression)是个好东西——能显著减少 token 用量、降低 LLM 调用成本。但有一个副作用很多人会遇到...
GitHub Actions 实战:生产级 Node.js CI/CD 流水线搭建全过程
很多团队把 CI/CD 停留在「能跑通就行」的状态:没有测试 gate、没有制品管理、没有回滚机制,一出问题就只能手动救火。本文记录我用 GitHub Actions 搭建一条生产级 Node.js CI/CD 流水线的完...
GitHub Actions 缓存失效的根因与解法:同一个 workflow 为什么时而快时而慢(临时标题)
GitHub Actions 缓存失效的根因与解法:同一个 workflow 为什么时而快时而慢 同一个 workflow,第一次跑 3 分钟,第二次跑 40 秒,第三次又回到 3 分钟。换了台机器反而更快。不是网络问题,不...
GitHub Actions 缓存失效的 4 种真实场景和对应解法
每次提交代码,GitHub Actions 都要重新安装一遍依赖?同一个项目,别人的 CI 跑 1 分钟,你的跑 8 分钟?问题大概率出在缓存策略上。本文总结 4 种最常见的缓存失效场景,配合可运行的配置文件...
Docker BuildKit 缓存失效:本地能跑 CI 不行的 2 个真实场景
# Docker BuildKit 缓存失效:本地能跑 CI 不行的 2 个真实场景 本地开发好好的 Dockerfile,CI 里每次都从零编译。一个下午排查完才发现——问题不在 Dockerfile,在于 CI 环境和本地的三处差...
GitHub Actions Docker 构建缓存失效的两个真实原因:token过期和dockerignore
问题:CI 构建每次从零编译 用 GitHub Actions 跑 Docker 构建,明明什么都没改,却每次都从零开始。缓存命中率 0%,CI 时间从 2 分钟飙升到 12 分钟。 根因有两个,都很隐蔽:GITHUB_TOKEN 24h...
LLM Token 预算告警:让对话机器人在崩溃前悬崖勒马的完整方案
背景:上线3个月后开始答非所问 我们的客服机器人跑了3个月后,开始出现'答非所问'的问题。用户说'查一下我的订单',AI 回的是'工单编号格式如下'。日志里单会话 token 已经突破 18 万,上下文...
AI 代码编辑器全面横评:Cursor、Copilot、Claude Code 谁更适合你?
过去一年,AI 代码编辑器赛道彻底爆发。从 GitHub Copilot 的代码补全,到 Cursor 的智能问答,再到 Claude Code 的多文件协作能力,每款工具都在重新定义'写代码'这件事。本文将从多个维度全面...
GitHub Actions Self-hosted Runners 三坑实录:PAT失效、私有镜像认证、本地缓存不通
解决了什么问题 GitHub 官方 runner 免费额度有限,自建 self-hosted runner 可以突破时间限制、访问内网资源。搭好 runner 后遇到三个新问题:Runner 注册 token 会过期、私有镜像拉取认证失败...
上下文压缩后 RAG 检索降级的 4 种应对策略
问题:压缩后 Embedding 变了 给 RAG 对话系统加上上下文压缩(对话历史摘要化)后,向量检索缓存命中率从 60% 跌到接近 0。这不是缓存本身坏了,而是压缩改变了对话历史的向量空间:同一个问题...











