streaming renderer
AI回答一个字一个字往外冒的时候,负责把这些字实际画到屏幕上的那部分程序
简单来说
流式渲染器(streaming renderer)是聊天机器人的回答一个字一个字往外冒出来时,负责把这些字真正画到屏幕上的那部分程序。
可以想象有人在白板上做速记。如果每冒出一个新单词,就把整块白板擦掉重新从头写一遍,那么文字越长,擦掉重写所花的时间就越长,最后手都跟不上了。反过来,如果只是把新出现的单词轻轻接到已有内容后面,那么无论白板写满了多少,手上的动作始终一样轻松。旧式的流式渲染器更接近前一种做法。回答短的时候还没问题,但回答越长,需要重新绘制的屏幕区域就越大,在配置较低的设备上,文字越堆积,屏幕就会时不时卡顿一下。
改动这一部分,负责生成答案的那个"大脑"部分不会受影响,只是调整了呈现在屏幕上的方式。所以这只会改变阅读者感受到的流畅度,跟回答的内容或准确性无关。
在报道中是这样出现的
文章中出现类似这样的句子:"看起来,原来的流式渲染器接近于每新增一段文字,就把整个屏幕重新画一遍的方式。"这里容易产生的一个误解是,以为这是跟回答的"内容"或"智能程度"有关的变化。实际上,改变的不是生成答案的部分,而只是把这个答案画到屏幕上的方式,跟回答的准确性或逻辑性是两件不相干的事。
亲手试一试
没有单独的开关设置。可以按以下步骤来体会一下:
- 像平时一样打开Claude的网页版或桌面应用。
- 提出一个足以让回答填满好几屏的请求,比如夹杂多个代码块的长说明,或者一份文档初稿。例如:"请用Python教我搭建一个简单的网络服务器,配上5个代码示例,一步一步非常详细地讲解。"
- 在回答持续输出的过程中,观察滚动是否会卡顿,屏幕是否会短暂停滞。
- 如果有一台配置较低的笔记本电脑,可以在那台设备上做同样的请求,比较一下差别。
