欢迎光临

人工智能和大数据

第10页
如何利用分块策略优化RAG系统的检索质量-汤不热吧

如何利用分块策略优化RAG系统的检索质量

andy阅读(78)

在构建RAG(检索增强生成)系统时,很多人把精力集中在选择更好的向量模型或更大的LLM上,却忽略了一个最基础却影响深远的环节——文档分块(Chunking)。分块策略的好坏直接决定了检索阶段能否找到真正相关的内容,进而影响最终生成答案的质量...

AI编译器与专用AI芯片的未来融合趋势?

andy阅读(274)评论(0)

如何利用TVM的BYOC功能加速AI模型在专用芯片上的部署 随着AI算力需求的激增,NPU、TPU等专用人工智能芯片(DSA)层出不穷。然而,如何让这些芯片快速适配种类繁多的模型框架(如PyTorch、TensorFlow)成了最大的痛点。...

对抗攻击研究的下一个十年将走向何方?

andy阅读(239)评论(0)

如何在AI基础设施中实施高效的对抗性防御策略以应对未来十年的模型安全挑战? 对抗性攻击(Adversarial Attacks)已经走过了最初的‘扰动像素点’阶段,进入了语义对抗、物理世界攻击以及针对大模型(LLM)的注入攻击时代。在未来的...

怎样建立一个AI伦理审查的标准操作程序(SOP)?

andy阅读(308)评论(0)

如何建立AI模型的自动化伦理审查与内容安全过滤SOP? 在生成式AI(AIGC)大规模落地的今天,AI伦理不再是一个空洞的口号,而是关系到企业合规、品牌声誉乃至法律安全的核心基石。一个完善的AI伦理审查标准操作程序(SOP)能够将抽象的伦理...

如何应对最新AI安全漏洞的快速缓解指南?

andy阅读(257)评论(0)

如何快速缓解AI推理服务中的模型反序列化与Prompt注入安全漏洞 在AI基础设施的生产环境中,安全漏洞往往出现在模型加载(反序列化)与用户交互(Prompt 注入)两个核心环节。作为AI Infra工程师,我们需要在不影响业务迭代的前提下...

怎样将模型公平性评估结果转化为具体的业务风险指标?

andy阅读(259)评论(0)

如何将AI模型公平性评估量化为具体的业务风险成本 在AI基础设施建设中,模型上线前的评估通常集中在准确率、召回率等性能指标。然而,随着全球监管趋严(如欧盟《人工智能法案》),公平性评估已成为模型部署的必经环节。对于业务方而言,单纯的公平性统...

未来五年AI Infra将如何应对万卡集群的挑战?

andy阅读(311)评论(0)

如何通过FSDP与异步分布式快照应对万卡集群的扩展性挑战 随着大模型参数量向万亿级迈进,AI Infra 的重心已从单机性能优化转向\”万卡集群\”的系统级工程。在万卡规模下,AI 基础设施面临两个致命挑战:节点平均...