Invest mentoring
Odebírat Ranního Bullionáře
Podcast
Burzovnisvet Logo
  • Headlines
    • Breaking
    • Bullionář Daily
    • Akcie
    • Hospodářské výsledky
    • ETF
    • Dividendy
    • IPO
    • Forex
    • Komodity
    • Kryptoměny
    • Ekonomika
  • Příležitost
  • DIP
  • IPO Radar
    TBA Bude oznámeno

    Finančně-technologická společnost nabízející širokou škálu finančních služeb

    TBA Bude oznámeno

    ​Komunikační platforma umožňující uživatelům komunikovat pomoci hlasu a textu

    TBA Bude oznámeno

    Britská digitální banka a první peer-to-peer (P2P) platforma na světě

    TBA Bude oznámeno

    Technologická společnost poskytující infrastrukturu pro online platby

    Zdroj: Shein
    TBA Bude oznámeno

    Čínska společnost pro globální online prodej rychlé módy za dostupné ceny

    TBA Bude oznámeno

    Společnost poskytující cloudovou platformu pro datovou analytiku

    TBA Bude oznámeno

    Švédská fintech společnost, která poskytuje služby „kup teď, zaplať později“

  • Úspěch
    • Alternativní investice
    • Škola bullionáře
    • Miliardáři
    • Business
    • Bullionářova knihspirace
    • Bullionářův almanach
    • Bullionářův slovníček
  • AI
  • Česko
  • E-booky
  • Srovnávač brokerů
  • Kariéra
  • Login
Burzovnisvet.cz - Akcie, kurzy, burza, forex, komodity, IPO, dluhopisy - zpravodajství
  • Headlines
    • Breaking
    • Bullionář Daily
    • Akcie
    • Hospodářské výsledky
    • ETF
    • Dividendy
    • IPO
    • Forex
    • Komodity
    • Kryptoměny
    • Ekonomika
  • Příležitost
  • DIP
  • IPO Radar
    TBA Bude oznámeno

    Finančně-technologická společnost nabízející širokou škálu finančních služeb

    TBA Bude oznámeno

    ​Komunikační platforma umožňující uživatelům komunikovat pomoci hlasu a textu

    TBA Bude oznámeno

    Britská digitální banka a první peer-to-peer (P2P) platforma na světě

    TBA Bude oznámeno

    Technologická společnost poskytující infrastrukturu pro online platby

    Zdroj: Shein
    TBA Bude oznámeno

    Čínska společnost pro globální online prodej rychlé módy za dostupné ceny

    TBA Bude oznámeno

    Společnost poskytující cloudovou platformu pro datovou analytiku

    TBA Bude oznámeno

    Švédská fintech společnost, která poskytuje služby „kup teď, zaplať později“

  • Úspěch
    • Alternativní investice
    • Škola bullionáře
    • Miliardáři
    • Business
    • Bullionářova knihspirace
    • Bullionářův almanach
    • Bullionářův slovníček
  • AI
  • Česko
  • E-booky
  • Srovnávač brokerů
  • Kariéra
    • Žádný výsledek
      Zobrazit všechny výsledky
BS Logo

Meta vydává model AI, který dokáže přepsat a přeložit téměř 100 jazyků

V rámci snahy vyvinout umělou inteligenci, která by rozuměla různým dialektům, vytvořila společnost Meta model umělé inteligence SeamlessM4T, který dokáže přeložit a přepsat téměř 100 jazyků textu a řeči.

David Škvára Autor: David Škvára
7 září, 2023
5 min. čtení
Zdroj: Burzovnísvět.cz

Zdroj: Burzovnísvět.cz

5 min.
čtení
Chcete využít této příležitosti? Přihlaste se k odběru newsletteru

Společnost Meta tvrdí, že SeamlessM4T, který je k dispozici jako otevřený zdrojový kód spolu s novou sadou dat pro překlad SeamlessAlign, představuje „významný průlom“ v oblasti převodu řeči a textu na základě umělé inteligence.

„Náš jednotný model poskytuje překlady na vyžádání, které umožňují lidem hovořícím různými jazyky efektivněji komunikovat,“ píše Meta v příspěvku na blogu, který sdílel TechCrunch. „SeamlessM4T implicitně rozpoznává zdrojové jazyky, aniž by bylo nutné používat samostatný model identifikace jazyka.“

SeamlessM4T je jakýmsi duchovním nástupcem modelu strojového překladu z textu do textu No Language Left Behind společnosti Meta a překladače Universal Speech Translator, jednoho z mála systémů přímého překladu z řeči do řeči, který podporuje jazyk hokkien. Vychází z Massively Multilingual Speech, frameworku společnosti Meta, který poskytuje technologie rozpoznávání řeči, identifikace jazyka a syntézy řeči ve více než 1 100 jazycích.

Zdroj: Meta

Společnost Meta není jediná, kdo investuje prostředky do vývoje sofistikovaných nástrojů pro překlad a přepis umělou inteligencí.

Kromě řady komerčních služeb a modelů s otevřeným zdrojovým kódem, které jsou již k dispozici od společností Amazon, Microsoft, OpenAI a řady startupů, vytváří společnost Google takzvaný univerzální řečový model, který je součástí širšího úsilí technologického gigantu o vytvoření modelu, který by dokázal porozumět 1000 nejpoužívanějším jazykům na světě. Společnost Mozilla mezitím stála v čele projektu Common Voice, jedné z největších vícejazyčných sbírek hlasů pro trénování algoritmů automatického rozpoznávání řeči.

Advertisement

SeamlessM4T však patří k dosud nejambicióznějším pokusům o spojení překladatelských a přepisovatelských schopností do jediného modelu.

Chcete využít této příležitosti?

Společnost Meta uvádí, že při jeho vývoji vybrala z webu veřejně dostupné texty (řádově „desítky miliard“ vět) a řeč (4 miliony hodin). V rozhovoru pro TechCrunch Juan Pino, vědecký pracovník výzkumné divize umělé inteligence společnosti Meta, který se na projektu podílel, nechtěl prozradit přesné zdroje dat, řekl pouze, že jich byla „celá řada“.

Ne každý tvůrce obsahu souhlasí s využíváním veřejných dat k trénování modelů, které by mohly být použity komerčně. Někteří z nich podali žaloby na společnosti, které vytvářejí nástroje umělé inteligence na základě veřejně dostupných dat, a tvrdí, že dodavatelé by měli být nuceni poskytnout uznání, pokud ne kompenzaci – a jasné způsoby, jak se z toho odhlásit.

While visiting Sweden, I came across this globe in a friend’s home. Its always interesting to see names of countries in different languages and Swedish is no different. The lighting made for an interesting selective focus shot.
Zdroj: Unsplash

Společnost Meta však tvrdí, že získaná data, která mohou obsahovat osobní údaje, nejsou chráněna autorskými právy a pocházejí především z otevřených nebo licencovaných zdrojů.

„Díky nejmodernějším výsledkům věříme, že SeamlessM4T je důležitým průlomem v úsilí komunity AI o vytvoření univerzálních multitaskingových systémů,“ napsala Meta na blogu.

Nedávný článek v The Conversation poukazuje na mnoho nedostatků v překladu pomocí umělé inteligence, včetně různých forem genderové zaujatosti. Překladač Google například kdysi v některých jazycích předpokládal, že lékaři jsou muži, zatímco zdravotní sestry jsou ženy.

Také algoritmy rozpoznávání řeči často obsahují zkreslení. Studie zveřejněná v časopise The Proceedings of the National Academy of Sciences ukázala, že systémy rozpoznávání řeči od předních společností dvakrát častěji nesprávně přepisovaly zvuk černošských mluvčích než bělošských.

Není překvapením, že SeamlessM4T není v tomto ohledu ojedinělý.

Zdroj: Getty Images

V dokumentu zveřejněném společně s blogovým příspěvkem společnost Meta odhaluje, že model „při překladu z neutrálních výrazů příliš zobecňuje na mužské tvary“ a u většiny jazyků funguje lépe při překladu z mužského rodu (např. podstatných jmen jako „on“ v angličtině).

Kromě toho, bez informace o pohlaví, SeamlessM4T preferuje překlad mužského rodu přibližně v 10 % případů – možná kvůli „nadměrnému zastoupení mužské lexiky“ v trénovacích datech, spekuluje Meta.

Společnost Meta tvrdí, že SeamlessM4T nepřidává do svých překladů nadměrné množství toxického textu, což je běžný problém překladů a generativních textových modelů AI obecně. Není však dokonalý. V některých jazycích, například v bengálštině a kyrgyzštině, vytváří SeamlessM4T více toxických překladů – tedy nenávistných nebo vulgárních překladů – týkajících se socioekonomického statusu a kultury. A obecně je SeamlessM4T toxičtější v překladech týkajících se sexuální orientace a náboženství.

Společnost Meta poznamenává, že veřejná ukázka pro SeamlessM4T obsahuje filtr pro toxicitu ve vstupní řeči i filtr pro potenciálně toxickou výstupní řeč. Tento filtr však není ve výchozím nastavení přítomen v otevřené verzi modelu.

Společnost Meta tvrdí, že SeamlessM4T, který je k dispozici jako otevřený zdrojový kód spolu s novou sadou dat pro překlad SeamlessAlign, představuje „významný průlom“ v oblasti převodu řeči a textu na základě umělé inteligence.„Náš jednotný model poskytuje překlady na vyžádání, které umožňují lidem hovořícím různými jazyky efektivněji komunikovat,“ píše Meta v příspěvku na blogu, který sdílel TechCrunch. „SeamlessM4T implicitně rozpoznává zdrojové jazyky, aniž by bylo nutné používat samostatný model identifikace jazyka.“SeamlessM4T je jakýmsi duchovním nástupcem modelu strojového překladu z textu do textu No Language Left Behind společnosti Meta a překladače Universal Speech Translator, jednoho z mála systémů přímého překladu z řeči do řeči, který podporuje jazyk hokkien. Vychází z Massively Multilingual Speech, frameworku společnosti Meta, který poskytuje technologie rozpoznávání řeči, identifikace jazyka a syntézy řeči ve více než 1 100 jazycích.Společnost Meta není jediná, kdo investuje prostředky do vývoje sofistikovaných nástrojů pro překlad a přepis umělou inteligencí.Kromě řady komerčních služeb a modelů s otevřeným zdrojovým kódem, které jsou již k dispozici od společností Amazon, Microsoft, OpenAI a řady startupů, vytváří společnost Google takzvaný univerzální řečový model, který je součástí širšího úsilí technologického gigantu o vytvoření modelu, který by dokázal porozumět 1000 nejpoužívanějším jazykům na světě. Společnost Mozilla mezitím stála v čele projektu Common Voice, jedné z největších vícejazyčných sbírek hlasů pro trénování algoritmů automatického rozpoznávání řeči.SeamlessM4T však patří k dosud nejambicióznějším pokusům o spojení překladatelských a přepisovatelských schopností do jediného modelu. Chcete využít této příležitosti?Společnost Meta uvádí, že při jeho vývoji vybrala z webu veřejně dostupné texty a řeč . V rozhovoru pro TechCrunch Juan Pino, vědecký pracovník výzkumné divize umělé inteligence společnosti Meta, který se na projektu podílel, nechtěl prozradit přesné zdroje dat, řekl pouze, že jich byla „celá řada“.Ne každý tvůrce obsahu souhlasí s využíváním veřejných dat k trénování modelů, které by mohly být použity komerčně. Někteří z nich podali žaloby na společnosti, které vytvářejí nástroje umělé inteligence na základě veřejně dostupných dat, a tvrdí, že dodavatelé by měli být nuceni poskytnout uznání, pokud ne kompenzaci – a jasné způsoby, jak se z toho odhlásit.Společnost Meta však tvrdí, že získaná data, která mohou obsahovat osobní údaje, nejsou chráněna autorskými právy a pocházejí především z otevřených nebo licencovaných zdrojů.„Díky nejmodernějším výsledkům věříme, že SeamlessM4T je důležitým průlomem v úsilí komunity AI o vytvoření univerzálních multitaskingových systémů,“ napsala Meta na blogu.Nedávný článek v The Conversation poukazuje na mnoho nedostatků v překladu pomocí umělé inteligence, včetně různých forem genderové zaujatosti. Překladač Google například kdysi v některých jazycích předpokládal, že lékaři jsou muži, zatímco zdravotní sestry jsou ženy.Také algoritmy rozpoznávání řeči často obsahují zkreslení. Studie zveřejněná v časopise The Proceedings of the National Academy of Sciences ukázala, že systémy rozpoznávání řeči od předních společností dvakrát častěji nesprávně přepisovaly zvuk černošských mluvčích než bělošských.Není překvapením, že SeamlessM4T není v tomto ohledu ojedinělý.V dokumentu zveřejněném společně s blogovým příspěvkem společnost Meta odhaluje, že model „při překladu z neutrálních výrazů příliš zobecňuje na mužské tvary“ a u většiny jazyků funguje lépe při překladu z mužského rodu .Kromě toho, bez informace o pohlaví, SeamlessM4T preferuje překlad mužského rodu přibližně v 10 % případů – možná kvůli „nadměrnému zastoupení mužské lexiky“ v trénovacích datech, spekuluje Meta.Společnost Meta tvrdí, že SeamlessM4T nepřidává do svých překladů nadměrné množství toxického textu, což je běžný problém překladů a generativních textových modelů AI obecně. Není však dokonalý. V některých jazycích, například v bengálštině a kyrgyzštině, vytváří SeamlessM4T více toxických překladů – tedy nenávistných nebo vulgárních překladů – týkajících se socioekonomického statusu a kultury. A obecně je SeamlessM4T toxičtější v překladech týkajících se sexuální orientace a náboženství.Společnost Meta poznamenává, že veřejná ukázka pro SeamlessM4T obsahuje filtr pro toxicitu ve vstupní řeči i filtr pro potenciálně toxickou výstupní řeč. Tento filtr však není ve výchozím nastavení přítomen v otevřené verzi modelu.
Tagy: AIAkcieMeta Platformsumela inteligence

Chcete využít této příležitosti?

Zanechte svůj telefon a email a budete kontaktováni licencovanými odborníky

      Advertisement

      Breaking.

      22:48

      Microsoft omezuje čínským firmám přístup k upozorněním na kybernetickou bezpečnost

      22:36

      Chilská společnost SQM očekává ve třetím čtvrtletí růst cen lithia

      22:24

      Ve čtvrtek se pozornost zaměří na údaje PMI, počet žádostí o podporu v nezaměstnanosti a prodej domů

      22:12

      TJX zvyšuje prognózu ročního zisku díky silné poptávce po zlevněném zboží

      22:00

      Americké námořnictvo buduje flotilu dronů proti Číně, projekt však naráží na problémy

      21:55

      Rafinerie BP ve Whitingu obnovuje provoz po přerušení kvůli povodním

      Advertisement

      Příležitosti.

      Zdroj: Getty Images
      Akcie

      JPMorgan věří v růst Upstart díky příznivému makroekonomickému prostředí

      20 srpna, 2025

      Společnost Upstart Holdings, poskytovatel online úvěrů využívající umělou inteligenci, se dostala do centra pozornosti investorů poté, co JPMorgan zvýšila své...

      Zdroj: Bloomberg

      Citi výrazně zvyšuje hodnocení Nu Holdings a očekává zrychlení růstu zisků

      20 srpna, 2025
      Zdroj: Getty Images

      Bank of America zvyšuje hodnocení Snowflake před zveřejněním výsledků

      20 srpna, 2025
      Zdroj: Shuangdeng

      IPO Shuangdeng: čínský lídr v oblasti baterií míří na hongkongskou burzu

      20 srpna, 2025
      Zdroj: Getty Images

      Výsledky Palo Alto přinesly nový optimismus pro kybernetickou bezpečnost

      20 srpna, 2025

      Tip editora.

      Zdroj: Getty Images
      AI

      Arm přetahuje klíčového manažera Amazonu a akceleruje plán na vlastní čipy

      19 srpna, 2025

      Společnost Arm Holdings posouvá svou strategii do nové fáze: najala Ramiho Sinna, dosavadního ředitele pro umělou inteligenci v Amazonu, aby...

      Nejčtenější zprávy.

      Zářijové snížení sazeb zůstává nejisté, Fed volí opatrný postup

      19 srpna, 2025

      S&P 500 končí mírně níže před projevem Powella v Jackson Hole

      18 srpna, 2025

      Trump a Putin jednali na Aljašce, zásadní posun ale nepřišel

      16 srpna, 2025

      Dolar posiluje před klíčovým týdnem pro monetární politiku USA

      18 srpna, 2025

      Oracle míří k bilionové hodnotě díky expanzi v umělé inteligenci

      16 srpna, 2025

      Akcie klesají, investoři se přesouvají z technologického sektoru

      19 srpna, 2025

      Index S&P 500 klesá v důsledku pokračujícího propadu technologických akcií

      20 srpna, 2025

      Smrtelný výbuch v závodě U.S. Steel otřásá důvěrou v budoucnost americké oceli

      17 srpna, 2025
      Advertisement

      IPO Radar.

      Revolut Group Holdings Ltd

      Datum IPO: 2025
      Potenciální ocenění: 45 miliard USD

      Buďte u toho
      Advertisement

      Veškeré materiály a informace umístěné na internetových stránkách Burzovního Světa jsou čerpány z veřejně dostupných zdrojů, jako napriklad tyto a slouží výhradně pro informační účely. Při jejich tvorbě bylo postupováno s vynaložením maximální péče. Informace uveřejněné na internetových stránkách Burzovní Svět nemají charakter právních, daňových či jiného doporučení, analýz nebo návrhů a nabídek ke koupi či prodeji investičních nástrojů, jejichž realizací může dojít k poklesu či ztrátě investovaného majetku. Investiční doporučení, která jsou takto označena, jsou pouze informativní a nezávazná. Burzovní Svět neodpovídá za jakoukoli případnou škodu, která v souvislosti s nimi vznikne. Pro obchodování s investičními nástroji proto využívejte výhradně společnosti s udělenou licencí ČNB, popřípadě s platným povolením k činnosti na území České Republiky.

      Burzovní Svět zároveň prohlašuje, že neodpovídá za přímou i nepřímou škodu vzniklou v důsledku obchodování na kapitálových trzích všeobecně a příspěvky v diskusích vyjadřující názory čtenářů, nemusí být v souladu s postojem provozovatele a není možno je tím pádem považovat za jeho názory. Udělením souhlasu / přijetím podmínek zároveň souhlasíte s možností zasílání, či jiného kontaktování v rámci marketingových služeb obchodních partnerů Burzovního Světa. Více informací o cookies

      • Zásady ochrany osobních údajů a cookies
      • Reklama
      • Kontakt

      Burzovnisvet.cz © 2025

      Burzovnisvet.cz © 2025

      Název nebo symbol
      Žádný výsledek
      Zobrazit všechny výsledky
      • Burzy
        • Headlines
        • Breaking
        • Akcie
        • ETF
        • Dividendy
        • IPO
        • Forex
        • Komodity
        • Kryptoměny
        • Ekonomika
        • Hospodářské výsledky
      • Příležitost
      • DIP
      • IPO Radar
      • Nejčtenější
      • Bullionář Daily
      • Úspěch
        • Alternativní investice
        • Škola bullionáře
        • Miliardáři
        • Business
        • Bullionářova knihspirace
        • Bullionářův almanach
        • Bullionářův slovníček
      • AI
      • Česko
      • Invest mentoring
      • E-booky
      • Srovnávač brokerů
      • Kariéra
      Odebírat Ranního Bullionáře Podcast

      Retrieve your password

      Please enter your username or email address to reset your password.