关于LLM流式输出的疑问

Author: Nadir-EchoCreated Jul 26, 2025Updated Aug 12, 2026

非常感谢作者的这个框架,我觉得抽象出来的不同类型,可以作为工程开发的一种规范。 我有一个疑问想请教一下作者, 举个例子,比如我要实现语音实时对话,我理解语音输入先转文字,一个节点。文字输入大模型一个节点,大模型stream输出到下一个节点语音合成再返回。如果要速度快的话,肯定是希望中间全部是流式的形式。也就是语音输入流式传入,调用asr函数流式输出,翻译的文本流式输入大模型,流式输出对应的回复,流式输入tts,流式输出对应的语音返回

我理解里面每一个步骤都应该是一个Node,但这样感觉跟原有的Node定义不太一眼个,并且原有Node,严格三步走的话最后都会要返回一个对应的default的action标识符的,感觉不太对,如果一个node包含上面的步骤,有感觉过于臃肿 参考https://github.com/The-Pocket/PocketFlow/issues/12