博客 - AI
RAG系统性能优化实战:从评估不达标到全面通关的完整历程 LLM系列
基于阿里云百炼+pgvector的RAG系统优化实战,使用Ragas框架进行专业评估。详细记录从4项指标不达标到全面通过的完整优化过程,包含LLM-as-a-Judge评估器创建、Rerank API修复、配置参数调优、模型选型优化。最终所有指标达标,生成延迟下降34%,成本降低60%。
RAGLLMAI阿里云优化pgvectorRagas
让大模型“深思熟虑”:ReAct、Self-Consistency 与 Tree-of-Thought 全解析 LLM系列
让大模型“深思熟虑”:ReAct、Self-Consistency 与 Tree-of-Thought 全解析
大语言模型LLMprompt-engineeringAIreasoning
Embedding模型详解:OpenAI/Cohere/BGE三大方案对比 LLM系列
在AI应用开发中,Embedding模型是连接自然语言和机器理解的关键桥梁。本文深入解析OpenAI、Cohere、BGE三大主流Embedding方案的技术原理、性能特点、应用场景,并提供详细的选型指南。无论你是在构建RAG系统、语义搜索引擎,还是推荐系统,这篇文章都能帮你做出最优选择。
Embedding文本向量化语义搜索机器学习AIRAG
1 / 2
下一页