Description
When transcribing audio waveforms longer than 30 seconds (e.g., 60s recording), calling transcribe(waveform, { verbose: false }) drops/discards all preceding 30-second windows and returns only the final 30-second window segment.
Passing { verbose: true } resolves the issue and returns the complete transcription across all 30-second windows.
Steps to reproduce
- Record or generate a PCM 16kHz
Float32Array audio waveform longer than 30 seconds (e.g., 60 seconds of speech).
- Execute
sttModel.transcribe(waveform, { language: 'en', verbose: false }).
- Inspect
result.text.
Snack or a link to a repository
No response
React Native Executorch version
latest
React Native version
0.86.2
Platforms
iOS
JavaScript runtime
None
Workflow
None
Architecture
None
Build type
None
Device
None
Device model
No response
AI model
No response
Performance logs
No response
Acknowledgements
Yes
Description
When transcribing audio waveforms longer than 30 seconds (e.g., 60s recording), calling
transcribe(waveform, { verbose: false })drops/discards all preceding 30-second windows and returns only the final 30-second window segment.Passing
{ verbose: true }resolves the issue and returns the complete transcription across all 30-second windows.Steps to reproduce
Float32Arrayaudio waveform longer than 30 seconds (e.g., 60 seconds of speech).sttModel.transcribe(waveform, { language: 'en', verbose: false }).result.text.Snack or a link to a repository
No response
React Native Executorch version
latest
React Native version
0.86.2
Platforms
iOS
JavaScript runtime
None
Workflow
None
Architecture
None
Build type
None
Device
None
Device model
No response
AI model
No response
Performance logs
No response
Acknowledgements
Yes