Pomoc investorům
Invest mentoring
Odebírat Ranního Bullionáře
Podcast
Burzovnisvet Logo
  • Headlines
    • Breaking
    • Bullionář Daily
    • Akcie
    • Hospodářské výsledky
    • ETF
    • Dividendy
    • IPO
    • Forex
    • Komodity
    • Kryptoměny
    • Ekonomika
  • Příležitost
  • DIP
  • IPO Radar

    Nadcházející IPO.

    02788.HK 24 listopadu, 2025

    Společnost působící v oblasti výroby elektrolytického hliníku

    PPHC 1 prosince, 2025

    Společnost specializující se na komunikaci v oblasti vládních vztahů

    CBC 20 listopadu, 2025

    Americká bankovní společnost poskytující komplexní služby bankovnictví

    TBA Bude oznámeno

    Americká platforma pro nákup a prodej vstupenek na sportovní a kulturní akce

    Minulé IPO.

    02579.HK 17 listopadu, 2025

    Společnost specializující se na nové materiály pro baterie

    AERO 6 listopadu, 2025

    Mexický letecký dopravce, který poskytuje mezinárodní i vnitrostátní lety

    BLLN 6 listopadu, 2025

    Molekulárně diagnostická společnost vyvíjející prenatalní a onkologické testy

    BETA 4 listopadu, 2025

    Beta Technologies a její úspešný vstup na americkou burzu

  • Úspěch
    • Alternativní investice
    • Škola bullionáře
    • Miliardáři
    • Business
    • Bullionářova knihspirace
    • Bullionářův almanach
    • Bullionářův slovníček
  • AI
  • Česko
  • E-booky
  • Srovnávač brokerů
  • Kariéra
  • Login
Burzovnisvet.cz - Akcie, kurzy, burza, forex, komodity, IPO, dluhopisy - zpravodajství
  • Headlines
    • Breaking
    • Bullionář Daily
    • Akcie
    • Hospodářské výsledky
    • ETF
    • Dividendy
    • IPO
    • Forex
    • Komodity
    • Kryptoměny
    • Ekonomika
  • Příležitost
  • DIP
  • IPO Radar

    Nadcházející IPO.

    02788.HK 24 listopadu, 2025

    Společnost působící v oblasti výroby elektrolytického hliníku

    PPHC 1 prosince, 2025

    Společnost specializující se na komunikaci v oblasti vládních vztahů

    CBC 20 listopadu, 2025

    Americká bankovní společnost poskytující komplexní služby bankovnictví

    TBA Bude oznámeno

    Americká platforma pro nákup a prodej vstupenek na sportovní a kulturní akce

    Minulé IPO.

    02579.HK 17 listopadu, 2025

    Společnost specializující se na nové materiály pro baterie

    AERO 6 listopadu, 2025

    Mexický letecký dopravce, který poskytuje mezinárodní i vnitrostátní lety

    BLLN 6 listopadu, 2025

    Molekulárně diagnostická společnost vyvíjející prenatalní a onkologické testy

    BETA 4 listopadu, 2025

    Beta Technologies a její úspešný vstup na americkou burzu

  • Úspěch
    • Alternativní investice
    • Škola bullionáře
    • Miliardáři
    • Business
    • Bullionářova knihspirace
    • Bullionářův almanach
    • Bullionářův slovníček
  • AI
  • Česko
  • E-booky
  • Srovnávač brokerů
  • Kariéra
    • Žádný výsledek
      Zobrazit všechny výsledky
BS Logo

Meta vydává model AI, který dokáže přepsat a přeložit téměř 100 jazyků

V rámci snahy vyvinout umělou inteligenci, která by rozuměla různým dialektům, vytvořila společnost Meta model umělé inteligence SeamlessM4T, který dokáže přeložit a přepsat téměř 100 jazyků textu a řeči.

David Škvára Autor: David Škvára
7 září, 2023
5 min. čtení
Zdroj: Burzovnísvět.cz

Zdroj: Burzovnísvět.cz

5 min.
čtení
Přihlaste se k odběru newsletteru
Chcete využít této příležitosti?

Společnost Meta tvrdí, že SeamlessM4T, který je k dispozici jako otevřený zdrojový kód spolu s novou sadou dat pro překlad SeamlessAlign, představuje „významný průlom“ v oblasti převodu řeči a textu na základě umělé inteligence.

„Náš jednotný model poskytuje překlady na vyžádání, které umožňují lidem hovořícím různými jazyky efektivněji komunikovat,“ píše Meta v příspěvku na blogu, který sdílel TechCrunch. „SeamlessM4T implicitně rozpoznává zdrojové jazyky, aniž by bylo nutné používat samostatný model identifikace jazyka.“

SeamlessM4T je jakýmsi duchovním nástupcem modelu strojového překladu z textu do textu No Language Left Behind společnosti Meta a překladače Universal Speech Translator, jednoho z mála systémů přímého překladu z řeči do řeči, který podporuje jazyk hokkien. Vychází z Massively Multilingual Speech, frameworku společnosti Meta, který poskytuje technologie rozpoznávání řeči, identifikace jazyka a syntézy řeči ve více než 1 100 jazycích.

Zdroj: Meta

Společnost Meta není jediná, kdo investuje prostředky do vývoje sofistikovaných nástrojů pro překlad a přepis umělou inteligencí.

Kromě řady komerčních služeb a modelů s otevřeným zdrojovým kódem, které jsou již k dispozici od společností Amazon, Microsoft, OpenAI a řady startupů, vytváří společnost Google takzvaný univerzální řečový model, který je součástí širšího úsilí technologického gigantu o vytvoření modelu, který by dokázal porozumět 1000 nejpoužívanějším jazykům na světě. Společnost Mozilla mezitím stála v čele projektu Common Voice, jedné z největších vícejazyčných sbírek hlasů pro trénování algoritmů automatického rozpoznávání řeči.

Advertisement

SeamlessM4T však patří k dosud nejambicióznějším pokusům o spojení překladatelských a přepisovatelských schopností do jediného modelu.

Chcete využít této příležitosti?

Společnost Meta uvádí, že při jeho vývoji vybrala z webu veřejně dostupné texty (řádově „desítky miliard“ vět) a řeč (4 miliony hodin). V rozhovoru pro TechCrunch Juan Pino, vědecký pracovník výzkumné divize umělé inteligence společnosti Meta, který se na projektu podílel, nechtěl prozradit přesné zdroje dat, řekl pouze, že jich byla „celá řada“.

Ne každý tvůrce obsahu souhlasí s využíváním veřejných dat k trénování modelů, které by mohly být použity komerčně. Někteří z nich podali žaloby na společnosti, které vytvářejí nástroje umělé inteligence na základě veřejně dostupných dat, a tvrdí, že dodavatelé by měli být nuceni poskytnout uznání, pokud ne kompenzaci – a jasné způsoby, jak se z toho odhlásit.

While visiting Sweden, I came across this globe in a friend’s home. Its always interesting to see names of countries in different languages and Swedish is no different. The lighting made for an interesting selective focus shot.
Zdroj: Unsplash

Společnost Meta však tvrdí, že získaná data, která mohou obsahovat osobní údaje, nejsou chráněna autorskými právy a pocházejí především z otevřených nebo licencovaných zdrojů.

„Díky nejmodernějším výsledkům věříme, že SeamlessM4T je důležitým průlomem v úsilí komunity AI o vytvoření univerzálních multitaskingových systémů,“ napsala Meta na blogu.

Nedávný článek v The Conversation poukazuje na mnoho nedostatků v překladu pomocí umělé inteligence, včetně různých forem genderové zaujatosti. Překladač Google například kdysi v některých jazycích předpokládal, že lékaři jsou muži, zatímco zdravotní sestry jsou ženy.

Také algoritmy rozpoznávání řeči často obsahují zkreslení. Studie zveřejněná v časopise The Proceedings of the National Academy of Sciences ukázala, že systémy rozpoznávání řeči od předních společností dvakrát častěji nesprávně přepisovaly zvuk černošských mluvčích než bělošských.

Není překvapením, že SeamlessM4T není v tomto ohledu ojedinělý.

Zdroj: Getty Images

V dokumentu zveřejněném společně s blogovým příspěvkem společnost Meta odhaluje, že model „při překladu z neutrálních výrazů příliš zobecňuje na mužské tvary“ a u většiny jazyků funguje lépe při překladu z mužského rodu (např. podstatných jmen jako „on“ v angličtině).

Kromě toho, bez informace o pohlaví, SeamlessM4T preferuje překlad mužského rodu přibližně v 10 % případů – možná kvůli „nadměrnému zastoupení mužské lexiky“ v trénovacích datech, spekuluje Meta.

Společnost Meta tvrdí, že SeamlessM4T nepřidává do svých překladů nadměrné množství toxického textu, což je běžný problém překladů a generativních textových modelů AI obecně. Není však dokonalý. V některých jazycích, například v bengálštině a kyrgyzštině, vytváří SeamlessM4T více toxických překladů – tedy nenávistných nebo vulgárních překladů – týkajících se socioekonomického statusu a kultury. A obecně je SeamlessM4T toxičtější v překladech týkajících se sexuální orientace a náboženství.

Společnost Meta poznamenává, že veřejná ukázka pro SeamlessM4T obsahuje filtr pro toxicitu ve vstupní řeči i filtr pro potenciálně toxickou výstupní řeč. Tento filtr však není ve výchozím nastavení přítomen v otevřené verzi modelu.

Společnost Meta tvrdí, že SeamlessM4T, který je k dispozici jako otevřený zdrojový kód spolu s novou sadou dat pro překlad SeamlessAlign, představuje „významný průlom“ v oblasti převodu řeči a textu na základě umělé inteligence.„Náš jednotný model poskytuje překlady na vyžádání, které umožňují lidem hovořícím různými jazyky efektivněji komunikovat,“ píše Meta v příspěvku na blogu, který sdílel TechCrunch. „SeamlessM4T implicitně rozpoznává zdrojové jazyky, aniž by bylo nutné používat samostatný model identifikace jazyka.“SeamlessM4T je jakýmsi duchovním nástupcem modelu strojového překladu z textu do textu No Language Left Behind společnosti Meta a překladače Universal Speech Translator, jednoho z mála systémů přímého překladu z řeči do řeči, který podporuje jazyk hokkien. Vychází z Massively Multilingual Speech, frameworku společnosti Meta, který poskytuje technologie rozpoznávání řeči, identifikace jazyka a syntézy řeči ve více než 1 100 jazycích.Společnost Meta není jediná, kdo investuje prostředky do vývoje sofistikovaných nástrojů pro překlad a přepis umělou inteligencí.Kromě řady komerčních služeb a modelů s otevřeným zdrojovým kódem, které jsou již k dispozici od společností Amazon, Microsoft, OpenAI a řady startupů, vytváří společnost Google takzvaný univerzální řečový model, který je součástí širšího úsilí technologického gigantu o vytvoření modelu, který by dokázal porozumět 1000 nejpoužívanějším jazykům na světě. Společnost Mozilla mezitím stála v čele projektu Common Voice, jedné z největších vícejazyčných sbírek hlasů pro trénování algoritmů automatického rozpoznávání řeči.SeamlessM4T však patří k dosud nejambicióznějším pokusům o spojení překladatelských a přepisovatelských schopností do jediného modelu.Chcete využít této příležitosti?Společnost Meta uvádí, že při jeho vývoji vybrala z webu veřejně dostupné texty a řeč . V rozhovoru pro TechCrunch Juan Pino, vědecký pracovník výzkumné divize umělé inteligence společnosti Meta, který se na projektu podílel, nechtěl prozradit přesné zdroje dat, řekl pouze, že jich byla „celá řada“.Ne každý tvůrce obsahu souhlasí s využíváním veřejných dat k trénování modelů, které by mohly být použity komerčně. Někteří z nich podali žaloby na společnosti, které vytvářejí nástroje umělé inteligence na základě veřejně dostupných dat, a tvrdí, že dodavatelé by měli být nuceni poskytnout uznání, pokud ne kompenzaci – a jasné způsoby, jak se z toho odhlásit.Společnost Meta však tvrdí, že získaná data, která mohou obsahovat osobní údaje, nejsou chráněna autorskými právy a pocházejí především z otevřených nebo licencovaných zdrojů.„Díky nejmodernějším výsledkům věříme, že SeamlessM4T je důležitým průlomem v úsilí komunity AI o vytvoření univerzálních multitaskingových systémů,“ napsala Meta na blogu.Nedávný článek v The Conversation poukazuje na mnoho nedostatků v překladu pomocí umělé inteligence, včetně různých forem genderové zaujatosti. Překladač Google například kdysi v některých jazycích předpokládal, že lékaři jsou muži, zatímco zdravotní sestry jsou ženy.Také algoritmy rozpoznávání řeči často obsahují zkreslení. Studie zveřejněná v časopise The Proceedings of the National Academy of Sciences ukázala, že systémy rozpoznávání řeči od předních společností dvakrát častěji nesprávně přepisovaly zvuk černošských mluvčích než bělošských.Není překvapením, že SeamlessM4T není v tomto ohledu ojedinělý.V dokumentu zveřejněném společně s blogovým příspěvkem společnost Meta odhaluje, že model „při překladu z neutrálních výrazů příliš zobecňuje na mužské tvary“ a u většiny jazyků funguje lépe při překladu z mužského rodu .Kromě toho, bez informace o pohlaví, SeamlessM4T preferuje překlad mužského rodu přibližně v 10 % případů – možná kvůli „nadměrnému zastoupení mužské lexiky“ v trénovacích datech, spekuluje Meta.Společnost Meta tvrdí, že SeamlessM4T nepřidává do svých překladů nadměrné množství toxického textu, což je běžný problém překladů a generativních textových modelů AI obecně. Není však dokonalý. V některých jazycích, například v bengálštině a kyrgyzštině, vytváří SeamlessM4T více toxických překladů – tedy nenávistných nebo vulgárních překladů – týkajících se socioekonomického statusu a kultury. A obecně je SeamlessM4T toxičtější v překladech týkajících se sexuální orientace a náboženství.Společnost Meta poznamenává, že veřejná ukázka pro SeamlessM4T obsahuje filtr pro toxicitu ve vstupní řeči i filtr pro potenciálně toxickou výstupní řeč. Tento filtr však není ve výchozím nastavení přítomen v otevřené verzi modelu.
Tagy: AIAkcieMeta Platformsumela inteligence


    Chcete využít této příležitosti?


    Zanechte své kontaktní údaje, ozve se Vám licencovaný specialista a zároveň získáte:

    • Přístup k nejžhavějším IPO a investičním trendům.

    • Pravidelnou dávku aktuálních tipů pro Vaše portfolio v našem Newsletteru.

    • Investiční portfolio

    Máte zkušenosti s investováním?

    Jakou částku jste připraven použít na investování?



    Odesláním formuláře souhlasíte se zasíláním newsletteru Burzovní svět. Odhlásit se můžete kdykoli.

    Související:

    1. Meta využívá umělou inteligenci k růstu a míří k hranici 3 bilionů USD
    2. Meta a Scale AI: miliardová sázka ohrožená odchody talentů a nejistotou
    3. Meta Platforms může do roku 2030 předstihnout Nvidii i Palantir
    4. Meta zmrazila nábor v oblasti AI a spouští rozsáhlou restrukturalizaci
    5. Meta Platforms je stále dominantní hráč v reklamě a vývoji AI
    Advertisement

    Breaking.

    19:43

    Výsledky FormPipe za 3. čtvrtletí 2025: Zvýšené marže vynikají během strategického prodeje aktiv

    19:42

    Kevin Kotler odhaluje 1,86% podíl v Avadel Pharmaceuticals

    19:38

    Cecil Hetherington nakupuje více než 3% podíl v Reach PLC.

    19:38

    Akcie Savara Inc dosáhly 52týdenního maxima na $4,51.

    19:33

    Logansport Financial oznamuje čtvrtletní dividendu ve výši 0,45 USD.

    19:32

    BlackRock zvýšil svůj podíl ve společnosti CVS Group na 5,02 %.

    Advertisement

    Příležitosti.

    Zdroj: Getty Images
    Akcie

    Jefferies vidí prostor pro další růst akcií společnosti DoorDash

    19 listopadu, 2025

    Společnost Jefferies výrazně zlepšila svůj pohled na DoorDash, dominantního hráče v oblasti doručování jídla v USA i na několika zahraničních...

    Výrazný růst Quantgroup – černý kůň hongkongského IPO boomu

    19 listopadu, 2025
    Zdroj: Getty Images

    Akcie s rychle rostoucími dividendami a silným cash flow lákají investory

    19 listopadu, 2025

    Hliníkový gigant Chuangxin míří na burzu s IPO za 5,5 miliardy HK$

    19 listopadu, 2025
    Zdroj: Getty Images

    Proč není příliš pozdě na nákup akcií společnosti Alphabet

    18 listopadu, 2025

    IPO Radar.

    Chuangxin Industries

    Datum IPO: 24 listopadu, 2025
    Potenciální ocenění: 20,36 miliard HKD až 21,98 miliard HKD

    Buďte u toho

    Nejčtenější zprávy.

    Nvidia čelí největšímu testu roku, který může otřást celým AI trhem

    18 listopadu, 2025

    Americké akcie klesají; pozornost se soustředí na klíčová ekonomická data

    17 listopadu, 2025

    Newyorská pobočka Fedu svolala schůzku s firmami z Wall Street

    15 listopadu, 2025

    S&P 500 klesá, optimistické sázky na budoucnost AI oslabují

    17 listopadu, 2025

    USA uzavřely obchodní dohodu se Švýcarskem, tvrdí úředníci

    15 listopadu, 2025

    Proměnlivá pozice amerického dolaru těsně před koncem roku

    18 listopadu, 2025

    Boeing hlásí silné objednávky, ale akcie dál klesají kvůli obavám z cash flow

    19 listopadu, 2025

    Dohoda Disney a YouTube TV potvrzuje rostoucí dominanci streamingu

    16 listopadu, 2025
    Advertisement

    Tip editora.

    Zdroj: Getty Images
    Akcie

    Akcie Alphabet rostou díky Buffettovi a trh čeká na klíčový AI katalyzátor

    18 listopadu, 2025

    Akcie společnosti Alphabet zažívají mimořádně silný rok a postupně se mění z technologického titulu, který byl ještě na začátku roku...

    Advertisement

    Veškeré materiály a informace umístěné na internetových stránkách Burzovního Světa jsou čerpány z veřejně dostupných zdrojů, jako napriklad tyto a slouží výhradně pro informační účely. Při jejich tvorbě bylo postupováno s vynaložením maximální péče. Informace uveřejněné na internetových stránkách Burzovní Svět nemají charakter právních, daňových či jiného doporučení, analýz nebo návrhů a nabídek ke koupi či prodeji investičních nástrojů, jejichž realizací může dojít k poklesu či ztrátě investovaného majetku. Investiční doporučení, která jsou takto označena, jsou pouze informativní a nezávazná. Burzovní Svět neodpovídá za jakoukoli případnou škodu, která v souvislosti s nimi vznikne. Pro obchodování s investičními nástroji proto využívejte výhradně společnosti s udělenou licencí ČNB, popřípadě s platným povolením k činnosti na území České Republiky.

    Burzovní Svět zároveň prohlašuje, že neodpovídá za přímou i nepřímou škodu vzniklou v důsledku obchodování na kapitálových trzích všeobecně a příspěvky v diskusích vyjadřující názory čtenářů, nemusí být v souladu s postojem provozovatele a není možno je tím pádem považovat za jeho názory. Udělením souhlasu / přijetím podmínek zároveň souhlasíte s možností zasílání, či jiného kontaktování v rámci marketingových služeb obchodních partnerů Burzovního Světa. Více informací o cookies

    • Zásady ochrany osobních údajů a cookies
    • Reklama
    • Kontakt

    Burzovnisvet.cz © 2025

    Burzovnisvet.cz © 2025

    Název nebo symbol
    Žádný výsledek
    Zobrazit všechny výsledky
    • Burzy
      • Headlines
      • Breaking
      • Akcie
      • ETF
      • Dividendy
      • IPO
      • Forex
      • Komodity
      • Kryptoměny
      • Ekonomika
      • Hospodářské výsledky
    • Příležitost
    • DIP
    • IPO Radar
    • Nejčtenější
    • Bullionář Daily
    • Úspěch
      • Alternativní investice
      • Škola bullionáře
      • Miliardáři
      • Business
      • Bullionářova knihspirace
      • Bullionářův almanach
      • Bullionářův slovníček
    • AI
    • Česko
    • Invest mentoring
    • E-booky
    • Srovnávač brokerů
    • Kariéra
    • Pomoc investorům
    Odebírat Ranního Bullionáře Podcast

    Retrieve your password

    Please enter your username or email address to reset your password.