跳转至

Qwen Streaming LLM

接收 Transcript 或上下文文本,输出原始语义助手响应增量。

属性
Node Type qwen.llm_stream
层级 / 角色 algorithm / transform
Capability language.generation.cancellable_streaming

Port

Port 方向 Schema
text_in 输入 Text Prompt 或轮次上下文,流式
signal_in 输入 Signal 用户开口时取消当前 SSE 请求并清空旧结果
text_out 输出 Text 助手响应增量,流式
event_out 输出 Event 回答完成状态

配置

model 默认是 qwen-flashsystem_prompt 定义助手行为;temperature 默认是 0.6。 语音呈现断句由下游 Speech Formatter 负责。HTTP SSE 在后台 Worker 中运行;Node 回调只负责启动请求或排空有界队列,因此 on_signal 能及时关闭进行中的响应,而不是等待 完整答案结束。Node 通过 Context 请求 Runtime 内部唤醒,无需 Clock Node 或 tick_in Port。 max_results_per_wakeup 默认是 32。 该 Node 不知道 Voice Room 或任何客户端协议;远程 UI 需要这些信息时,由项目 Node 映射 text_outevent_out

接口遵循阿里云 Qwen OpenAI 兼容流式输出协议。