Embedding 是什么?AI 为什么能按语义搜索
Embedding 可以理解为把文字、图片、音频等内容转换成一串数字向量。AI 能按语义搜索,不是因为它像关键词搜索一样逐字匹配,而是因为相近含义会在向量空间里靠得更近。 一个直观例子 如果用户搜索“怎么退货”,文档里写的是“申请售后退款流程”,传统关键词搜索可能匹配不到;Embedding 搜索会...
找到 23 篇相关文章
Embedding 可以理解为把文字、图片、音频等内容转换成一串数字向量。AI 能按语义搜索,不是因为它像关键词搜索一样逐字匹配,而是因为相近含义会在向量空间里靠得更近。 一个直观例子 如果用户搜索“怎么退货”,文档里写的是“申请售后退款流程”,传统关键词搜索可能匹配不到;Embedding 搜索会...
RAG 是 Retrieval-Augmented Generation,中文常叫检索增强生成。它的核心不是让模型记住所有资料,而是在回答前先从外部知识库找相关内容,再让大模型基于这些内容生成答案。 它解决的是什么问题 普通大模型只依赖训练时学到的知识和当前输入,遇到公司制度、产品文档、合同条款、最...
Qwen3.6-Max-Preview 已上线,这是 Qwen 公开预览的下一代旗舰模型。按照官方说法,这一版本相较 Qwen3.6-Plus,重点补强了 agentic coding、世界知识和指令遵循能力,同时把真实世界任务中的可靠性再往前推了一步。对国内大模型市场来说,这更像一次面向“可执行 ...
稀疏注意力可以简单理解成:不是让每个 token 都去看所有 token,而是有选择地只看其中一部分。这个词会反复出现在长上下文和推理成本讨论里,是因为标准全注意力虽然强,但一旦上下文特别长,计算和显存成本就会涨得很快。 为什么“全看一遍”会越来越贵 在标准注意力里,文本越长,彼此之间需要计算的关系...
上下文工程(Context Engineering)不是把提示词写得更花,而是系统性决定“模型这次到底能看到什么、先看到什么、该忽略什么”。如果说提示词工程更像写一句好问题,那么上下文工程更像在搭整个输入环境。很多人觉得 AI 任务不稳,是模型不够强,其实常常是上下文喂得太乱。 它和提示词工程到底差...
让 AI 输出 JSON 总翻车,最常见的原因不是它“不懂 JSON”,而是你给的目标太宽、字段太松、容错又没补。模型可以学会按结构说话,但它不是天然可靠的序列化程序。你只要求“请返回 JSON”,却不限制字段、类型和缺失值处理,最后多一段解释、少一个引号、字段名忽然改写,都是高频结果。 常见翻车点...