Menu
  • Home
  • O nás
  • Projekty ▾
    • Výzkum
    • Detektor urážek
    • Český detektor emocí
    • Anglický detektor emocí
    • Veřejné mínění emocí
    • Startup Akademie
  • Kariéra
  • Kontakt
  • Kalendář
  • Blog
Skip to content

Whisper – převádí mluvené slovo na text

by Rosie | Posted on 28. 9. 202215. 1. 2023

S radostí vám oznamuji, že OpenAI uvolnila další produkt ze své pozoruhodné dílny. Jmenuje se„Whisper“. Whisper je univerzální end-to-end slabě dohlížená rodina modelů ASR (Automatic Speech Recognition) založených na transformátorech. Řečeno prostě, převádí mluvené slovo na text. A dělá to způsobem, který označujeme jako „General-purpose“, čili kromě rozpoznání řeči může provádět také úlohy jako je detekce hlasu, identifikace jazyka, přepis a strojový překlad.

Whisper – převádí mluvené slovo na text

Vychází hned celá rodina modelů s různou velikostí. Od nejmenších po největší z hlediska parametrů: Tiny (39M), základní (74B), malý (244B), střední (769M) a velký (1,55B). Skvělé je, že vychází jako open source! Zájemci si mohou snadno vyzkoušet online demo a poškádlit jak model funguje v češtině (nebo ti zvědavější/šikovnější rovnou stáhnout z GitHubu). Ještě perlička na závěr. Modely mysli trénované na 77 letech mluveného proslovu staženého z netu, což je tuším nevětší podobný dataset svého druhu.

Zdroje:

– Demo na Hugging Face: https://huggingface.co/spaces/openai/whisper?fbclid=IwAR1RZI5q9KqWp9eFHRuFPXpIB1WUyOLXWt7JBDo_4KJafnkpWYVF-gbAyzs

– Open AI blog: https://openai.com/blog/whisper/?fbclid=IwAR02-8MW800lMmtVGgfynk2UTXxk41Q1-9ZhMs6W9H5vM5VY11y_QVhQHMI

– Paper: https://cdn.openai.com/papers/whisper.pdf

– GitHub: https://github.com/openai/whisper

– Colab: https://colab.research.google.com/…/LibriSpeech.ipynb

– Medium: https://towardsdatascience.com/openai-whisper-holds-the-key-to-gpt-4-a7f922a7dad9

Post Views: 822
AI Intelligence Genetické algoritmy Novinky Strojové učení Text a sekvenceAI umělá inteligence

Related Posts

23 dubna, 2020

Položte otázku Tomášovi Mikolovovi přes Nadační fond Neuron

20 listopadu, 2018

Pokud vás zajímá, jak pracujeme na vývoji AI tak se stavte v Palalení polis!

8 listopadu, 2017

Server Pornhub využívá AI pro označování a třídění svých videí

Nejnovější příspěvky

  • Digi Dvojče Jana Tyla napsalo další článek
  • Článek s pomocí digitálního dvojčete Jana Tyla
  • Umění digitálního věku
  • Revoluce v programování – Claude Code
  • DigiHavel ve školách slaví úspěch u dětí

Archivy

Rubriky

Štítky

AI AI Awards algoritmus algoritmy Alphai Alpha Industries Amazon Andrew Ng BERT Chatbot DALL·E Deep Learning DigiHavel digitální filosof Digitální spisovatel Dita Malečková Elon Musk Facebook Google GPT-2 GPT-3 GPU Hyperprostor IBM Inovace Jan Tyl Matylda Microsoft Neuronová síť NEWSPARK NLP NVIDIA OpenAI podcast Přednáška RNN Robot soutěž startup strojové učení technologie TensorFlow Tomáš Sedláček umělá inteligence Český rozhlas
Copyright Alpha Industries – blog. All rights reserved. | Powered by WordPress & Writers Blogily Theme
Alpha Industries - blog
  • Home
  • O nás
  • Projekty
    • Výzkum
    • Detektor urážek
    • Český detektor emocí
    • Anglický detektor emocí
    • Veřejné mínění emocí
    • Startup Akademie
  • Kariéra
  • Kontakt
  • Kalendář
  • Blog