欢迎光临

人工智能和大数据

第9页
Qdrant 向量数据库深度解析:从架构设计到生产部署的完整指南-汤不热吧

Qdrant 向量数据库深度解析:从架构设计到生产部署的完整指南

andy阅读(128)

为什么生产环境需要 Qdrant:向量数据库的架构设计哲学 随着大语言模型(LLM)和检索增强生成(RAG)技术的广泛落地,向量数据库已经成为现代 AI 基础设施中不可或缺的一环。在众多向量数据库产品中,Qdrant 凭借其独特的 Rust...

LLM推理优化实战:从KV-Cache到Continuous Batching的技术演进与代码实现-汤不热吧

LLM推理优化实战:从KV-Cache到Continuous Batching的技术演进与代码实现

andy阅读(89)

引言:为什么LLM推理优化如此重要? 随着大语言模型(LLM)的广泛应用,从ChatGPT到开源模型的遍地开花,LLM的推理效率已成为制约AI落地的关键瓶颈。训练好一个模型只是第一步,如何让它在生产环境中以低成本、低延迟运行,才是真正的挑战...

一文搞懂Spark SQL Shuffle调优:从原理到实战的完整指南-汤不热吧

一文搞懂Spark SQL Shuffle调优:从原理到实战的完整指南

andy阅读(104)

在Spark SQL的实际开发中,Shuffle是影响作业性能的关键瓶颈之一。每当执行groupBy、join、repartition等宽依赖算子时,数据需要在不同节点间重新分布,这个过程就是Shuffle。不合理的Shuffle配置会导致...

详解梯度提升决策树(GBDT)原理与Scikit-learn实战-汤不热吧

详解梯度提升决策树(GBDT)原理与Scikit-learn实战

andy阅读(103)

梯度提升决策树(Gradient Boosted Decision Trees,GBDT)是机器学习中最强大、应用最广泛的算法之一。从Kaggle竞赛到工业界推荐系统、搜索排序,GBDT及其衍生版本(如XGBoost、LightGBM)长期...

详解Python SciPy数据插值实战:从线性插值到三次样条插值-汤不热吧

详解Python SciPy数据插值实战:从线性插值到三次样条插值

andy阅读(89)

在科学计算和数据分析中,数据插值是一项非常基础且实用的技术。无论是处理传感器采样数据、补充缺失值,还是生成平滑的曲线用于可视化,插值都扮演着关键角色。Python的SciPy库提供了强大的 1scipy.interpolate 模块,支持从...

一文搞懂TensorFlow自定义训练循环的实现与优化-汤不热吧

一文搞懂TensorFlow自定义训练循环的实现与优化

andy阅读(105)

在TensorFlow 2.x中,Keras提供了高层的 1model.fit() 接口,大多数场景下使用起来非常方便。但当我们需要更精细地控制训练过程时——比如实现梯度裁剪、多优化器交替更新、对抗训练(GAN)或者自定义学习率调度——就需...

如何利用 PostgreSQL pgvector 扩展实现高效的向量相似度搜索-汤不热吧

如何利用 PostgreSQL pgvector 扩展实现高效的向量相似度搜索

andy阅读(99)

在向量搜索领域,Faiss、Milvus、Elasticsearch 等专用引擎占据主流,但对于许多中小规模应用场景,引入一套全新的向量数据库意味着额外的运维成本和架构复杂度。PostgreSQL 作为最广泛使用的关系型数据库之一,通过 p...