PromptHub

Streaming

Quick Definition

Sending LLM tokens to clients as they are generated

Full Definition

Sending LLM tokens to clients as they are generated for real-time responsiveness.

Examples

chat interfaces, real-time responses, SSE

Related Terms

inference-optimization user-experience

More Large Language Models Terms