[Feature] WebSocket streaming audio input for ASR (#22848)

Co-authored-by: Yihao Wang <42559837+AgainstEntropy@users.noreply.github.com>
This commit is contained in:
Sam H
2026-05-27 22:44:55 +08:00
committed by GitHub
co-authored by Yihao Wang
parent 034dd39189
commit a95b4e2e09
11 changed files with 1707 additions and 49 deletions
@@ -51,7 +51,10 @@ class _MockTokenizerManager:
# Not a real ServerArgs, so base class sets allowed_custom_labels=None.
# Default tests assume cumulative-text streaming (the sglang upstream
# default); tests for incremental_streaming_output=True override this.
self.server_args = Mock(incremental_streaming_output=False)
self.server_args = Mock(
incremental_streaming_output=False,
asr_max_concurrent_sessions=32,
)
self.tokenizer = Mock()
self._stream_chunks = stream_chunks
@@ -255,7 +258,10 @@ class TestStreamingIncrementalOutputMode(CustomTestCase):
for i, d in enumerate(chunk_deltas)
]
tm = _MockTokenizerManager(chunks)
tm.server_args = Mock(incremental_streaming_output=True)
tm.server_args = Mock(
incremental_streaming_output=True,
asr_max_concurrent_sessions=32,
)
serving = OpenAIServingTranscription(tm)
request = TranscriptionRequest(model="whisper", stream=True)