DGX Spark 和 GPU 集群上跑 vLLM 部署或长任务时,用 tmux 把命令从 SSH 会话里摘出来,再集成进 Makefile;窗格分割做实时监控,nohup 和 systemd 各管一段。
2026 年多仓库微服务文档聚合策略:Docs-as-Code + Docusaurus 统一门户
多仓库微服务的文档体系,我最后用的是中央架构 Repo 加各服务 Repo 内的 /docs/ 目录,再用 Docusaurus 收成统一入口,文档贴近代码,检索入口只有一个。
Codex CLI 对接远程 Ollama
Codex CLI 用自定义 Provider 配置对接远程 Ollama,网络走 Tailscale,本地编码助手就能用上 Homelab 上的模型;模型怎么选、本地和远程的能力边界在哪也写了。
Stripe 支付接入基线:PaymentIntent 抽象、Mock/真实网关切换与后续 Webhook 演进
接入真实支付前,得先把支付抽象和 provider 边界理顺。Shop Platform 当前实现里,wallet-service 的 PaymentIntent 抽象、Stripe/PayPal/Klarna/Wallet 支付方式矩阵、Mock 与真实网关的切换已经跑通,webhook、退款幂等和 Payment Element 还没落地。
Kubernetes VPA InPlace Resize:原理、实战与落地注意点
基于 Kubernetes 1.35 官方文档和实操验证,梳理 VPA 的 InPlaceOrRecreate 模式、原地调容的工作链路,以及落地时最容易踩的坑。
电商 Guest-First 购物体验:无需注册也能完整下单
注册门槛往往会抬高结账流失。Shop Platform 现在的做法是 guest JWT 加 Redis 游客购物车(TTL 48 小时),游客订单靠 order_token 追踪,登录后再合并购物车;buyer-portal 和 buyer-app 在这段体验上还有差别。
用两台 GB10 跑 DeepSeek-V4-Flash:149GB 权重、sm_121 引擎选型与 MTP 调优后的吞吐
用两台 DGX Spark(GB10)部署 DeepSeek-V4-Flash(284B/13B-active,官方 FP8):为什么 128GB 单机装不下 149GB 权重、如何为 GB10 的 sm_121 架构选对 vLLM 引擎、源码构建中 torch 被悄悄降级的隐蔽问题,以及 MTP 调优后的实际吞吐。
K8s Service 访问链路:域名如何解析到 ClusterIP,再转发到 Pod
我顺着一个 Pod DNS 排查短视频,把 K8s Service 网络链路重新整理了一遍:DNS 解析、ClusterIP 到 Pod IP 的 DNAT、EndpointSlice、负载均衡,以及 1.36 时代 iptables/IPVS/nftables/eBPF 的取舍。
Spring Boot 3.4+ 的结构化日志:5 行配置启用 ECS,用 Fluent API 写出 OpenSearch 可查的字段
Spring Boot 3.4+ 内建了 ECS 结构化日志支持,5 行配置能替掉大部分手写的 logback-spring.xml,再用 SLF4J Fluent API 把字段写成 OpenSearch 查得到、聚得起来的样子。
feature 加得快,不等于产品更好,AI 时代的一点克制
读 Nick Hodges 的《A new challenge for software product managers》后,我顺手记下几条工程师视角的补充:当 AI 把“工作量”这道闸拆掉后,我会怎么判断一个 feature 值不值得进来。