Uncensored Bot 打开聊天

一段对话的记忆,究竟存在于哪里

2026-08-19

模型什么都不记得。每一个请求,都会连同新消息一起,携带更早的消息,而一个上限,决定了能容纳多少。当对话超过这个上限时,最早的消息就会被丢弃,这个助手会在没有它们的情况下作答。

遗忘,读起来像是注意力上的一个缺陷,实际上,是运算上的一个缺陷。知道是哪一种,会改变你的应对方式:把自己的话说得更大声,没有用;一段简短的总结,才有用。

每一个请求,都是一次全新的开始

模型被给予文字,返回一段续写。在两次请求之间,它什么都不保留。一切看起来像记忆的东西,都是产品在重新发送你更早的消息,这也是为什么一段长对话,运行起来比一段短对话花费更多。

这个上限,是以token计算的,而不是以消息计算的

一个token,大致相当于一个短单词,或者其中的一部分。这个预算,把指令、对话、你的新问题和回答,全都算在一起。这就是为什么一个长问题,可能会让一个答案变短,也是为什么一段塞满了长篇粘贴文字的对话,会比消息数量相同的另一段对话,更早耗尽。

什么会先被丢掉

在大多数服务上,最早的消息,会先被丢弃,这意味着你在一开始给出的那些设定,是最可能消失的部分。那些设定,通常正是重要的那部分,所以这不是一个随机的失败:它去掉的,恰恰是你本想保留的那部分语境。

在这个上限内工作

开始一段新对话,用一段三句话的总结开场,说明重要的内容。这比在一段已经丢失了开头的对话里争论,花费更少,还能把重要的语境放在最新的一端,让它得以留存。每个任务保持一段对话,也有帮助,因为这个预算,会花在相关的文字上,而不是无关的历史记录上。

粘贴问题之前

有些聊天机器人,会在多个会话之间记住东西吗?

有些会存储关于你的笔记,把它们附加到之后的对话里。那是一个存储起来的档案,而不是模型里的记忆,是一个独立的功能,有独立的设置。

要求它记住,有用吗?

在一段对话内部,这没有任何区别,因为一切反正都会被重新发送。跨对话来说,只有当产品拥有一个存储时才有用,而这时,是那个存储在起作用。

为什么它有时能记起一段长对话的开头?

因为这段对话还没有超过那个上限,或者产品对更早的消息做了总结,而不是直接丢弃。这两种行为都存在,也都不会被特意告知。

开始一段对话,给它三句话的语境,看看它能保持多久。

打开无审查聊天机器人

聊天机器人内部是如何运作的