
Vald 云原生分布式向量搜索引擎深度解析:从架构设计到 Kubernetes 生产部署完整指南
Vald 是什么:云原生时代的向量搜索基础设施 在大模型和 RAG 应用爆发式增长的今天,向量搜索已经成为 AI 基础设施中不可或缺的一环。从 Milvus、Qdrant 到 Weaviate,市面上已有不少向量数据库方案。然而,这些方案在...

Vald 是什么:云原生时代的向量搜索基础设施 在大模型和 RAG 应用爆发式增长的今天,向量搜索已经成为 AI 基础设施中不可或缺的一环。从 Milvus、Qdrant 到 Weaviate,市面上已有不少向量数据库方案。然而,这些方案在...

在 Kubernetes 集群的日常运维中,你是否遇到过这样的场景:集群刚搭建好时,Pod 在各节点上分布得很均匀,但随着时间推移——节点扩容、Pod 驱逐、手动调度——某些节点开始变得拥挤,而新加入的节点却几乎空闲。这种调度偏斜不仅浪费资...
随着汤不热吧技术社区访问量持续增长,社区面临的网络安全威胁也日益复杂。从SQL注入、XSS跨站脚本攻击到分布式DDoS流量洪峰,传统的基于规则匹配的Web应用防火墙已经难以应对快速演变的攻击手法。经过三个月的调研与测试,社区技术团队正式上线...
在大规模数据处理场景中,Spark 集群的资源利用率一直是工程师们关注的核心问题。传统的静态资源分配模式下,每个 Executor 从作业启动到结束都占用固定资源,即使处于空闲状态也无法释放,导致大量资源浪费。Spark 动态资源分配(Dy...

在 Kubernetes 集群中,网络问题一直是最难排查的故障类型之一。当一个服务调用另一个服务超时,你可能会问:是网络策略拦截了流量?是 DNS 解析出了问题?还是目标 Pod 根本没有收到请求?传统的排查方式需要登录节点抓包、查看 ip...
随着汤不热吧技术社区的容器化规模持续扩张——目前生产集群已承载超过 120 个微服务、日均处理请求量峰值突破 800 万——传统的 Prometheus + 单点 Grafana 监控方案逐渐暴露出三大痛点:指标、日志、链路数据分散存储导致...

为什么需要 KEDA?传统 HPA 的局限性 Kubernetes 原生的 Horizontal Pod Autoscaler(HPA)基于 CPU 和内存等资源指标进行自动扩缩容,这在大多数常规 Web 服务场景下工作良好。然而,当你的应...

概述:从传统 CI/CD 到 GitOps 的演进 汤不热吧技术社区自成立以来,一直致力于为开发者提供高质量的技术内容与交流平台。随着社区用户量的持续增长和微服务架构的广泛应用,我们原有的基于 Jenkins + Shell 脚本的持续部署...

为什么你需要 OPA/Gatekeeper? 随着 Kubernetes 集群规模的增长,多团队共享集群的场景变得越来越普遍。开发团队自助部署应用、运维团队负责基础设施——这种模式下,如何确保每个人都遵守集群的安全规范?如何防止有人提交了违...

随着社区文章数量突破 3000 篇,传统的基于 SQL LIKE 的全文搜索已经难以满足用户精准获取技术内容的需求。为此,汤不热吧技术社区近期完成了 AI 语义搜索系统的建设——基于 Milvus 向量数据库与 LangChain 框架,构...