Invest mentoring
Odebírat Ranního Bullionáře
Podcast
Burzovnisvet Logo
  • Headlines
    • Breaking
    • Bullionář Daily
    • Akcie
    • Hospodářské výsledky
    • ETF
    • Dividendy
    • IPO
    • Forex
    • Komodity
    • Kryptoměny
    • Ekonomika
  • Příležitost
  • DIP
  • IPO Radar
    VSURE 8 října, 2025

    Bezpečnostní společnost poskytující monitorované bezpečnostní služby

    TBA Bude oznámeno

    Finančně-technologická společnost nabízející širokou škálu finančních služeb

    Zdroj: Shein
    TBA Bude oznámeno

    Čínska společnost pro globální online prodej rychlé módy za dostupné ceny

  • Úspěch
    • Alternativní investice
    • Škola bullionáře
    • Miliardáři
    • Business
    • Bullionářova knihspirace
    • Bullionářův almanach
    • Bullionářův slovníček
  • AI
  • Česko
  • E-booky
  • Srovnávač brokerů
  • Kariéra
  • Login
Burzovnisvet.cz - Akcie, kurzy, burza, forex, komodity, IPO, dluhopisy - zpravodajství
  • Headlines
    • Breaking
    • Bullionář Daily
    • Akcie
    • Hospodářské výsledky
    • ETF
    • Dividendy
    • IPO
    • Forex
    • Komodity
    • Kryptoměny
    • Ekonomika
  • Příležitost
  • DIP
  • IPO Radar
    VSURE 8 října, 2025

    Bezpečnostní společnost poskytující monitorované bezpečnostní služby

    TBA Bude oznámeno

    Finančně-technologická společnost nabízející širokou škálu finančních služeb

    Zdroj: Shein
    TBA Bude oznámeno

    Čínska společnost pro globální online prodej rychlé módy za dostupné ceny

  • Úspěch
    • Alternativní investice
    • Škola bullionáře
    • Miliardáři
    • Business
    • Bullionářova knihspirace
    • Bullionářův almanach
    • Bullionářův slovníček
  • AI
  • Česko
  • E-booky
  • Srovnávač brokerů
  • Kariéra
    • Žádný výsledek
      Zobrazit všechny výsledky
BS Logo

Meta vydává model AI, který dokáže přepsat a přeložit téměř 100 jazyků

V rámci snahy vyvinout umělou inteligenci, která by rozuměla různým dialektům, vytvořila společnost Meta model umělé inteligence SeamlessM4T, který dokáže přeložit a přepsat téměř 100 jazyků textu a řeči.

David Škvára Autor: David Škvára
7 září, 2023
5 min. čtení
Zdroj: Burzovnísvět.cz

Zdroj: Burzovnísvět.cz

5 min.
čtení
Přihlaste se k odběru newsletteru
Chcete využít této příležitosti?

Společnost Meta tvrdí, že SeamlessM4T, který je k dispozici jako otevřený zdrojový kód spolu s novou sadou dat pro překlad SeamlessAlign, představuje „významný průlom“ v oblasti převodu řeči a textu na základě umělé inteligence.

„Náš jednotný model poskytuje překlady na vyžádání, které umožňují lidem hovořícím různými jazyky efektivněji komunikovat,“ píše Meta v příspěvku na blogu, který sdílel TechCrunch. „SeamlessM4T implicitně rozpoznává zdrojové jazyky, aniž by bylo nutné používat samostatný model identifikace jazyka.“

SeamlessM4T je jakýmsi duchovním nástupcem modelu strojového překladu z textu do textu No Language Left Behind společnosti Meta a překladače Universal Speech Translator, jednoho z mála systémů přímého překladu z řeči do řeči, který podporuje jazyk hokkien. Vychází z Massively Multilingual Speech, frameworku společnosti Meta, který poskytuje technologie rozpoznávání řeči, identifikace jazyka a syntézy řeči ve více než 1 100 jazycích.

Zdroj: Meta

Společnost Meta není jediná, kdo investuje prostředky do vývoje sofistikovaných nástrojů pro překlad a přepis umělou inteligencí.

Kromě řady komerčních služeb a modelů s otevřeným zdrojovým kódem, které jsou již k dispozici od společností Amazon, Microsoft, OpenAI a řady startupů, vytváří společnost Google takzvaný univerzální řečový model, který je součástí širšího úsilí technologického gigantu o vytvoření modelu, který by dokázal porozumět 1000 nejpoužívanějším jazykům na světě. Společnost Mozilla mezitím stála v čele projektu Common Voice, jedné z největších vícejazyčných sbírek hlasů pro trénování algoritmů automatického rozpoznávání řeči.

Advertisement

SeamlessM4T však patří k dosud nejambicióznějším pokusům o spojení překladatelských a přepisovatelských schopností do jediného modelu.

Chcete využít této příležitosti?

Společnost Meta uvádí, že při jeho vývoji vybrala z webu veřejně dostupné texty (řádově „desítky miliard“ vět) a řeč (4 miliony hodin). V rozhovoru pro TechCrunch Juan Pino, vědecký pracovník výzkumné divize umělé inteligence společnosti Meta, který se na projektu podílel, nechtěl prozradit přesné zdroje dat, řekl pouze, že jich byla „celá řada“.

Ne každý tvůrce obsahu souhlasí s využíváním veřejných dat k trénování modelů, které by mohly být použity komerčně. Někteří z nich podali žaloby na společnosti, které vytvářejí nástroje umělé inteligence na základě veřejně dostupných dat, a tvrdí, že dodavatelé by měli být nuceni poskytnout uznání, pokud ne kompenzaci – a jasné způsoby, jak se z toho odhlásit.

While visiting Sweden, I came across this globe in a friend’s home. Its always interesting to see names of countries in different languages and Swedish is no different. The lighting made for an interesting selective focus shot.
Zdroj: Unsplash

Společnost Meta však tvrdí, že získaná data, která mohou obsahovat osobní údaje, nejsou chráněna autorskými právy a pocházejí především z otevřených nebo licencovaných zdrojů.

„Díky nejmodernějším výsledkům věříme, že SeamlessM4T je důležitým průlomem v úsilí komunity AI o vytvoření univerzálních multitaskingových systémů,“ napsala Meta na blogu.

Nedávný článek v The Conversation poukazuje na mnoho nedostatků v překladu pomocí umělé inteligence, včetně různých forem genderové zaujatosti. Překladač Google například kdysi v některých jazycích předpokládal, že lékaři jsou muži, zatímco zdravotní sestry jsou ženy.

Také algoritmy rozpoznávání řeči často obsahují zkreslení. Studie zveřejněná v časopise The Proceedings of the National Academy of Sciences ukázala, že systémy rozpoznávání řeči od předních společností dvakrát častěji nesprávně přepisovaly zvuk černošských mluvčích než bělošských.

Není překvapením, že SeamlessM4T není v tomto ohledu ojedinělý.

Zdroj: Getty Images

V dokumentu zveřejněném společně s blogovým příspěvkem společnost Meta odhaluje, že model „při překladu z neutrálních výrazů příliš zobecňuje na mužské tvary“ a u většiny jazyků funguje lépe při překladu z mužského rodu (např. podstatných jmen jako „on“ v angličtině).

Kromě toho, bez informace o pohlaví, SeamlessM4T preferuje překlad mužského rodu přibližně v 10 % případů – možná kvůli „nadměrnému zastoupení mužské lexiky“ v trénovacích datech, spekuluje Meta.

Společnost Meta tvrdí, že SeamlessM4T nepřidává do svých překladů nadměrné množství toxického textu, což je běžný problém překladů a generativních textových modelů AI obecně. Není však dokonalý. V některých jazycích, například v bengálštině a kyrgyzštině, vytváří SeamlessM4T více toxických překladů – tedy nenávistných nebo vulgárních překladů – týkajících se socioekonomického statusu a kultury. A obecně je SeamlessM4T toxičtější v překladech týkajících se sexuální orientace a náboženství.

Společnost Meta poznamenává, že veřejná ukázka pro SeamlessM4T obsahuje filtr pro toxicitu ve vstupní řeči i filtr pro potenciálně toxickou výstupní řeč. Tento filtr však není ve výchozím nastavení přítomen v otevřené verzi modelu.

Společnost Meta tvrdí, že SeamlessM4T, který je k dispozici jako otevřený zdrojový kód spolu s novou sadou dat pro překlad SeamlessAlign, představuje „významný průlom“ v oblasti převodu řeči a textu na základě umělé inteligence.„Náš jednotný model poskytuje překlady na vyžádání, které umožňují lidem hovořícím různými jazyky efektivněji komunikovat,“ píše Meta v příspěvku na blogu, který sdílel TechCrunch. „SeamlessM4T implicitně rozpoznává zdrojové jazyky, aniž by bylo nutné používat samostatný model identifikace jazyka.“SeamlessM4T je jakýmsi duchovním nástupcem modelu strojového překladu z textu do textu No Language Left Behind společnosti Meta a překladače Universal Speech Translator, jednoho z mála systémů přímého překladu z řeči do řeči, který podporuje jazyk hokkien. Vychází z Massively Multilingual Speech, frameworku společnosti Meta, který poskytuje technologie rozpoznávání řeči, identifikace jazyka a syntézy řeči ve více než 1 100 jazycích.Společnost Meta není jediná, kdo investuje prostředky do vývoje sofistikovaných nástrojů pro překlad a přepis umělou inteligencí.Kromě řady komerčních služeb a modelů s otevřeným zdrojovým kódem, které jsou již k dispozici od společností Amazon, Microsoft, OpenAI a řady startupů, vytváří společnost Google takzvaný univerzální řečový model, který je součástí širšího úsilí technologického gigantu o vytvoření modelu, který by dokázal porozumět 1000 nejpoužívanějším jazykům na světě. Společnost Mozilla mezitím stála v čele projektu Common Voice, jedné z největších vícejazyčných sbírek hlasů pro trénování algoritmů automatického rozpoznávání řeči.SeamlessM4T však patří k dosud nejambicióznějším pokusům o spojení překladatelských a přepisovatelských schopností do jediného modelu.Chcete využít této příležitosti?Společnost Meta uvádí, že při jeho vývoji vybrala z webu veřejně dostupné texty a řeč . V rozhovoru pro TechCrunch Juan Pino, vědecký pracovník výzkumné divize umělé inteligence společnosti Meta, který se na projektu podílel, nechtěl prozradit přesné zdroje dat, řekl pouze, že jich byla „celá řada“.Ne každý tvůrce obsahu souhlasí s využíváním veřejných dat k trénování modelů, které by mohly být použity komerčně. Někteří z nich podali žaloby na společnosti, které vytvářejí nástroje umělé inteligence na základě veřejně dostupných dat, a tvrdí, že dodavatelé by měli být nuceni poskytnout uznání, pokud ne kompenzaci – a jasné způsoby, jak se z toho odhlásit.Společnost Meta však tvrdí, že získaná data, která mohou obsahovat osobní údaje, nejsou chráněna autorskými právy a pocházejí především z otevřených nebo licencovaných zdrojů.„Díky nejmodernějším výsledkům věříme, že SeamlessM4T je důležitým průlomem v úsilí komunity AI o vytvoření univerzálních multitaskingových systémů,“ napsala Meta na blogu.Nedávný článek v The Conversation poukazuje na mnoho nedostatků v překladu pomocí umělé inteligence, včetně různých forem genderové zaujatosti. Překladač Google například kdysi v některých jazycích předpokládal, že lékaři jsou muži, zatímco zdravotní sestry jsou ženy.Také algoritmy rozpoznávání řeči často obsahují zkreslení. Studie zveřejněná v časopise The Proceedings of the National Academy of Sciences ukázala, že systémy rozpoznávání řeči od předních společností dvakrát častěji nesprávně přepisovaly zvuk černošských mluvčích než bělošských.Není překvapením, že SeamlessM4T není v tomto ohledu ojedinělý.V dokumentu zveřejněném společně s blogovým příspěvkem společnost Meta odhaluje, že model „při překladu z neutrálních výrazů příliš zobecňuje na mužské tvary“ a u většiny jazyků funguje lépe při překladu z mužského rodu .Kromě toho, bez informace o pohlaví, SeamlessM4T preferuje překlad mužského rodu přibližně v 10 % případů – možná kvůli „nadměrnému zastoupení mužské lexiky“ v trénovacích datech, spekuluje Meta.Společnost Meta tvrdí, že SeamlessM4T nepřidává do svých překladů nadměrné množství toxického textu, což je běžný problém překladů a generativních textových modelů AI obecně. Není však dokonalý. V některých jazycích, například v bengálštině a kyrgyzštině, vytváří SeamlessM4T více toxických překladů – tedy nenávistných nebo vulgárních překladů – týkajících se socioekonomického statusu a kultury. A obecně je SeamlessM4T toxičtější v překladech týkajících se sexuální orientace a náboženství.Společnost Meta poznamenává, že veřejná ukázka pro SeamlessM4T obsahuje filtr pro toxicitu ve vstupní řeči i filtr pro potenciálně toxickou výstupní řeč. Tento filtr však není ve výchozím nastavení přítomen v otevřené verzi modelu.
Tagy: AIAkcieMeta Platformsumela inteligence

Chcete využít této příležitosti?

Zanechte svůj telefon a email a budete kontaktováni licencovanými odborníky

      Související:

      1. Meta využívá umělou inteligenci k růstu a míří k hranici 3 bilionů USD
      2. Meta investuje miliardy do AI expertů, analytik varuje před riziky
      3. Meta a Scale AI: miliardová sázka ohrožená odchody talentů a nejistotou
      4. Meta investuje miliardy do chytrých brýlí a kupuje podíl v EssilorLuxottica
      5. Meta Platforms může do roku 2030 předstihnout Nvidii i Palantir
      6. Meta zmrazila nábor v oblasti AI a spouští rozsáhlou restrukturalizaci
      7. Meta vynakládá obrovské částky, aby se dostala do čela v AI
      8. Meta Platforms je stále dominantní hráč v reklamě a vývoji AI
      Advertisement

      Breaking.

      17:52

      MOG Digitech míří na nové trhy s inovativní pojišťovací technologií

      16:22

      Saúdská burza posiluje: Výrazné zisky v dopravě a vzdělávání

      15:22

      Wall Street na špičkách: Politická nejistota ohrožuje rekordní růst akcií

      14:01

      Katar: Soukromý sektor roste, navzdory poklesu objednávek

      13:56

      Egyptský soukromý sektor čelí propadu zakázek a růstu cen

      13:52

      Kuvajtský soukromý sektor čelí nejpomalejšímu růstu za rok

      Advertisement

      Příležitosti.

      Zdroj: Shutterstock
      Příležitost

      Dokáže gigant Pfizer konečně zvrátit svůj dlouhodobý pokles?

      5 října, 2025

      Společnost Pfizer (PFE), jeden z největších a historicky nejuznávanějších farmaceutických gigantů světa, prochází v posledních letech obtížným obdobím. Přestože jde...

      Zdroj: Getty images

      Goldman přidává Hershey na říjnový seznam „největších přesvědčení“

      5 října, 2025
      Zdroj: Getty Images

      Akcie Freeport-McMoRan – zotavení po katastrofě může přinést růst

      5 října, 2025
      Zdroj: Getty Images

      Bank of America vybrala pro říjen akcie s větším potenciálem růstu

      5 října, 2025
      Zdroj: Shutterstock

      Tesla dosáhla rekordu, Musk si připisuje astronomické bohatství

      3 října, 2025

      IPO Radar.

      Verisure Plc.

      Datum IPO: 8 října, 2025
      Potenciální ocenění: 12,9 - 13,9 miliard eur (přibližně 16,3 miliard dolarů).

      Buďte u toho

      Nejčtenější zprávy.

      USA Rare Earth roste díky spekulacím o investici Trumpovy administrativy

      4 října, 2025

      Tesla dosáhla rekordu, Musk si připisuje astronomické bohatství

      3 října, 2025

      S&P 500 uzavřel nad 6 700 body díky sázkám na omezený dopad shutdownu

      1 října, 2025

      S&P 500 zaznamenal týdenní růst navzdory shutdownu vlády USA

      3 října, 2025

      Zlato na maximech signalizuje slabý dolar a hrozbu korekce akcií i bitcoinu

      1 října, 2025

      Sektor služeb v USA slábne a zvyšuje tlak na snížení sazeb Fedu

      4 října, 2025

      QuantumScape získává pozornost trhu díky revoluci v bateriích

      5 října, 2025

      S&P 500 zaznamenal další rekordní uzavření navzdory pokračujícímu shutdownu

      2 října, 2025
      Advertisement

      Tip editora.

      Zdroj: Getty Images
      AI

      Tyto akcie AI vynikají jako vítězové v dodavatelském řetězci

      30 září, 2025

      Umělá inteligence se stala jedním z největších motorů růstu polovodičového průmyslu a každá zpráva o dodavatelském řetězci přitahuje pozornost investorů.

      Advertisement

      Veškeré materiály a informace umístěné na internetových stránkách Burzovního Světa jsou čerpány z veřejně dostupných zdrojů, jako napriklad tyto a slouží výhradně pro informační účely. Při jejich tvorbě bylo postupováno s vynaložením maximální péče. Informace uveřejněné na internetových stránkách Burzovní Svět nemají charakter právních, daňových či jiného doporučení, analýz nebo návrhů a nabídek ke koupi či prodeji investičních nástrojů, jejichž realizací může dojít k poklesu či ztrátě investovaného majetku. Investiční doporučení, která jsou takto označena, jsou pouze informativní a nezávazná. Burzovní Svět neodpovídá za jakoukoli případnou škodu, která v souvislosti s nimi vznikne. Pro obchodování s investičními nástroji proto využívejte výhradně společnosti s udělenou licencí ČNB, popřípadě s platným povolením k činnosti na území České Republiky.

      Burzovní Svět zároveň prohlašuje, že neodpovídá za přímou i nepřímou škodu vzniklou v důsledku obchodování na kapitálových trzích všeobecně a příspěvky v diskusích vyjadřující názory čtenářů, nemusí být v souladu s postojem provozovatele a není možno je tím pádem považovat za jeho názory. Udělením souhlasu / přijetím podmínek zároveň souhlasíte s možností zasílání, či jiného kontaktování v rámci marketingových služeb obchodních partnerů Burzovního Světa. Více informací o cookies

      • Zásady ochrany osobních údajů a cookies
      • Reklama
      • Kontakt

      Burzovnisvet.cz © 2025

      Burzovnisvet.cz © 2025

      Název nebo symbol
      Žádný výsledek
      Zobrazit všechny výsledky
      • Burzy
        • Headlines
        • Breaking
        • Akcie
        • ETF
        • Dividendy
        • IPO
        • Forex
        • Komodity
        • Kryptoměny
        • Ekonomika
        • Hospodářské výsledky
      • Příležitost
      • DIP
      • IPO Radar
      • Nejčtenější
      • Bullionář Daily
      • Úspěch
        • Alternativní investice
        • Škola bullionáře
        • Miliardáři
        • Business
        • Bullionářova knihspirace
        • Bullionářův almanach
        • Bullionářův slovníček
      • AI
      • Česko
      • Invest mentoring
      • E-booky
      • Srovnávač brokerů
      • Kariéra
      Odebírat Ranního Bullionáře Podcast

      Retrieve your password

      Please enter your username or email address to reset your password.