Embedding向量嵌入/嵌入表示模型技术Embedding 是将文本、图片等数据转换为向量(数字数组)的技术,使计算机能计算语义相似度。是 RAG、语义搜索、推荐系统的核心技术。Embedding向量RAG查看详解
Fine-tuning微调模型技术Fine-tuning(微调)指在预训练大模型基础上,用领域特定数据进一步训练,让模型适配特定任务或风格。与 Prompt Engineering、RAG 并列为让 LLM 学会领域知识的三种方式。本文拆解微调的原理、三类方法、与 RAG/Prompt 的对比、适用场景与踩坑要点。Fine-tuning微调LLM查看详解
Hallucination幻觉基础概念Hallucination(幻觉)指大语言模型生成看似合理但与事实不符的内容。这是 LLM 最棘手的缺陷,根源在于模型的概率生成机制。本文拆解幻觉的成因、四类典型表现、检测方法与缓解策略,帮你识别和应对 AI 的「一本正经地胡说八道」。Hallucination幻觉LLM查看详解
MCP模型上下文协议协议标准MCP(Model Context Protocol)是 Anthropic 推出的开放协议,让 AI 模型能够安全地访问外部数据源和工具。类似于 AI 世界的 USB-C 接口,统一了 LLM 与外部资源的连接方式。MCP协议Anthropic查看详解
RAG检索增强生成模型技术RAG(Retrieval-Augmented Generation)是一种让 AI 基于外部知识库回答问题的技术,解决了大模型知识过时和幻觉问题。是企业落地 AI 最常用的架构。RAG知识库Embedding查看详解
Token令牌/词元基础概念Token 是大模型处理文本的最小单位,也是 API 计费的基础。1 个 Token 约等于 0.75 个英文单词或 0.5 个中文字。理解 Token 对控制成本至关重要。Token计费API查看详解