Smallest AI का Pulse ~64ms टाइम-टू-फर्स्ट-टोकन और 5.42% औसत WER (ओपन ASR लीडरबोर्ड पर #2) के साथ प्रबंधित (managed) रीयल-टाइम स्पीच-टू-टेक्स्ट प्रदान करता है, जबकि ओपन-सोर्स Whisper large-v3 के लिए यह ~7.4% है। Whisper को खुद होस्ट करने से लाइसेंस शुल्क तो समाप्त हो जाता है, लेकिन इससे स्ट्रीमिंग, सटीकता और GPU-ops का बोझ बढ़ जाता है; इसके विपरीत, Pulse कम-विलंबता (low-latency) वाले प्रबंधित प्रदर्शन के बदले प्रति-मिनट शुल्क लेता है।

पल्स स्पीच-टू-टेक्स्ट
लाइव वॉयस एजेंटों के लिए निर्मित, उद्योग-अग्रणी सटीकता और ~64ms टाइम-टू-फर्स्ट-टोकन के साथ रीयल-टाइम ट्रांसक्रिप्शन।

30+ भाषाएँ
30 से अधिक भाषाओं में सटीक ट्रांसक्रिप्शन, जिसमें ओपन एएसआर (ASR) लीडरबोर्ड पर मूल अंग्रेजी प्रदर्शन को दूसरा स्थान दिया गया है।

एंटरप्राइज़-ग्रेड अनुपालन
एसओसी 2 टाइप II, जीडीपीआर, आईएसओ 27001, और हिपा (HIPAA)-अनुकूल — स्वास्थ्य सेवा परिनियोजन के लिए उपलब्ध 'बिजनेस एसोसिएट एग्रीमेंट' के साथ।
विशेषताएं
बेंचमार्क
हगिंग फेस ईएसबी (Hugging Face ESB) बेंचमार्क (9 अंग्रेजी डेटासेट, स्ट्रीमिंग) पर WER %। जितना कम हो उतना बेहतर है। Pulse कुल मिलाकर प्रतिस्पर्धी है और मीटिंग/शोर वाले ऑडियो पर सबसे आगे है; AssemblyAI साफ़ तौर पर पढ़ी गई आवाज़ (clean read speech) में सबसे आगे है। स्रोत: HF ESB, आंतरिक मूल्यांकन।
अक्सर पूछे जाने वाले
प्रश्न
क्या ओपन-सोर्स स्पीच रिकग्निशन मुफ्त है?
क्या व्हिस्पर (Whisper) रियल-टाइम स्ट्रीमिंग का समर्थन करता है?
ओपन-सोर्स STT को खुद होस्ट करना (self-hosting) कब सही रहता है?
ओपन-सोर्स मॉडल्स की तुलना में पल्स (Pulse) कितना सटीक है?
क्या पल्स (Pulse) एक सेल्फ-होस्टेड मॉडल की तरह ऑन-प्रेमिस (on-premise) चल सकता है?
सेल्फ-होस्टेड Whisper से Pulse पर जाने में क्या शामिल है?

