
Whisper
Whisper to model rozpoznawania mowy opracowany przez OpenAI, udostępniony z otwartymi wagami. Zamienia nagranie audio na tekst, obsługuje wiele języków — w tym polski — i radzi sobie z nagraniami o niższej jakości oraz akcentami.
Zobacz wybrane projekty dla naszych klientów
Model można uruchomić na własnym sprzęcie albo korzystać z niego przez API. Wariant lokalny bywa wybierany tam, gdzie nagrania nie mogą opuścić organizacji — na przykład przy rozmowach z klientami lub dokumentacji medycznej.
Typowe zastosowania to transkrypcje spotkań, napisy do materiałów wideo, indeksowanie treści audio pod wyszukiwanie oraz wejście głosowe w aplikacjach.


