返回文章列表

上下文窗口

找到 11 篇相关文章

Claude 为什么没聊几轮就提示达到使用上限?真正吃配额的往往不是消息条数,而是长上下文、附件和 Artifact

Claude 为什么没聊几轮就提示达到使用上限?真正吃配额的往往不是消息条数,而是长上下文、附件和 Artifact

如果你在 Claude 里明明没发几条消息,却已经被提示达到使用上限,最该先改的不是发言频率,而是任务结构。Anthropic 现在对 Pro 使用限制的说明很明确:真正影响额度的,不只是你发了多少条,还包括消息长度、当前对话总长度、附件大小,以及你用的模型和功能是不是更吃算力。 所以“我才聊十几句...

AI问答 Admin
221
长上下文压缩(Context Compression)是什么?为什么模型上下文越来越长,它反而更重要

长上下文压缩(Context Compression)是什么?为什么模型上下文越来越长,它反而更重要

长上下文压缩说的不是简单删字,而是把长材料里的关键信息尽量保留下来,用更短、更可喂给模型的形式重新组织。这个概念会越来越重要,恰恰是因为上下文窗口越来越长了。窗口变大不代表你就该什么都往里塞,真正的问题变成:哪些内容值得保留,哪些只是占位置。 为什么“窗口更长”反而让压缩更关键 - 长材料一旦全塞进...

AI百科 Admin
71
稀疏注意力(Sparse Attention)是什么?为什么长上下文和推理成本问题总会谈到它

稀疏注意力(Sparse Attention)是什么?为什么长上下文和推理成本问题总会谈到它

稀疏注意力可以简单理解成:不是让每个 token 都去看所有 token,而是有选择地只看其中一部分。这个词会反复出现在长上下文和推理成本讨论里,是因为标准全注意力虽然强,但一旦上下文特别长,计算和显存成本就会涨得很快。 为什么“全看一遍”会越来越贵 在标准注意力里,文本越长,彼此之间需要计算的关系...

AI百科 Admin
83
让 AI 总结长文为什么总漏重点?先别急着怪上下文窗口,先改任务拆法和输出格式

让 AI 总结长文为什么总漏重点?先别急着怪上下文窗口,先改任务拆法和输出格式

AI 总结长文总漏重点,真正的原因通常不是上下文窗口不够,而是你把“读文”“筛重点”“组织输出”三个任务一次性丢给它了。只要目标太大、输出要求太空,模型就会优先给你一个看起来顺的概括,而不是把真正关键的条款、结论、条件和例外都抓出来。想让总结更稳,第一步不是换更大模型,而是把任务拆开。 先把“总结”...

AI问答 Admin
96
Token 是什么?为什么一段话会被 AI 切成很多小块

Token 是什么?为什么一段话会被 AI 切成很多小块

Token 可以理解成模型处理文本时的“最小工作单元”。它不一定等于一个字、一个词或者一个标点,更像是模型自己切出来的片段。英文里一个单词可能拆成几个 token,中文里一个短句也可能被拆成多个 token。 这件事看起来抽象,但它直接影响三件最现实的事:你能塞多少内容进去、一次对话会花多少钱、模型...

AI百科 Admin
68

推荐工具

更多