排序
LLM 上下文窗口优化:实战场景下的三种截断策略对比
用 LLM 处理长文本时,上下文窗口不是你想塞多少就塞多少的。超过上限直接报错,截断策略选错了关键信息被切,模型 hallucinate。本文对比三种真实在用的截断策略,给出具体代码和实测结论。 问...
LLM 上下文窗口溢出维修实录:3个真实踩坑案例与工程解法
问题:上下文窗口不是无限的 上线客服机器人三个月后,用户开始反馈'答非所问'。查日志发现单会话 token 数已经突破 18 万——上下文窗口爆了,最关键的用户订单信息被截断在最前面,模型根本'...
GitHub Actions docker login-action v3 三个真实坑:权限/作用域/缓存不统一
# GitHub Actions docker login-action v3 三个真实坑:权限/作用域/缓存不统一 用 GitHub Actions 跑 Docker 构建,registry 认证是最基础的操作,但 docker/login-action@v3 这个 Action 在自...
GitHub Actions 环境配置的两个真实坑:inputs默认值和secrets作用域
用 GitHub Actions 的 workflow_dispatch 配合 environment 字段,蓝绿部署、灰度发布都能搭。但跑起来有两个容易踩的坑:inputs 的默认值在特定触发方式下不生效,以及 environment secrets 在...
GitHub Actions fail-fast 陷阱:我的矩阵任务被团灭始末
问题场景:12 个矩阵任务被「团灭」 用矩阵策略跑 12 个测试组合,一个组合失败了,另外 11 个正在运行的任务全部被 GitHub Actions 强制取消,白跑了 40 分钟。 这不是网络波动,是 fail-fast ...
RAG 上下文压缩后缓存失效的根因与三个解法
# RAG 上下文压缩后缓存失效的根因与三个解法 用 RAG 跑生产环境时,上下文压缩(Context Compression)是个好东西——能显著减少 token 用量、降低 LLM 调用成本。但有一个副作用很多人会遇到...
GitHub Actions cache 三个真实坑:restore-keys 软匹配、容量上限、lookup-only 陷阱
问题现象 GitHub Actions 跑了三个月,cache 命中率始终在 30% 徘徊。明明每次只改了一行代码,却每次都重新下载 400MB 的 node_modules。直到加了 restore-keys,命中率也没见涨。 restore-key...
GitHub Actions 实战:生产级 Node.js CI/CD 流水线搭建全过程
很多团队把 CI/CD 停留在「能跑通就行」的状态:没有测试 gate、没有制品管理、没有回滚机制,一出问题就只能手动救火。本文记录我用 GitHub Actions 搭建一条生产级 Node.js CI/CD 流水线的完...
AI 代码编辑器全面横评:Cursor、Copilot、Claude Code 谁更适合你?
过去一年,AI 代码编辑器赛道彻底爆发。从 GitHub Copilot 的代码补全,到 Cursor 的智能问答,再到 Claude Code 的多文件协作能力,每款工具都在重新定义'写代码'这件事。本文将从多个维度全面...
GitHub Actions 缓存 save 失败不报错:我踩过的三个坑
结论先行 用 actions/cache 时,如果缓存体积超过 10GB,save 操作会静默失败——CI 跑 ✅ success,但缓存根本没存进去。本文讲清楚 actions/cache v4 的三个行为差异,以及如何正确配置缓存。...
Docker BuildKit 缓存失效:本地能跑 CI 不行的 2 个真实场景
# Docker BuildKit 缓存失效:本地能跑 CI 不行的 2 个真实场景 本地开发好好的 Dockerfile,CI 里每次都从零编译。一个下午排查完才发现——问题不在 Dockerfile,在于 CI 环境和本地的三处差...
FastAPI 依赖注入实战:三个让我翻过车的 Depends 场景
前言 FastAPI 的依赖注入用起来很顺手——路径函数参数里加个 Depends(get_current_user),认证就自动做了。但我用了一年多,真踩过三个让我debug到凌晨的坑:Depends 的参数在路由匹配前就解析...











