QwQ-32B-Preview s 32,5 miliardy parametry konkuruje modelům od OpenAI a je dostupný ke stažení pod licencí Apache 2.0
Model dosahuje lepších výsledků v testech logiky a matematiky, ale má slabiny v otázkách vyžadujících „zdravý rozum“
Regulace čínské vlády ovlivňují politické odpovědi modelu, přičemž některá témata jsou zcela obcházena
Jako jeden z mála konkuruje modelu o1 od OpenAI a jako první je k dispozici ke stažení pod povolenou licencí.
Model QwQ-32B-Preview, vyvinutý týmem Qwen společnosti Alibaba, obsahuje 32,5 miliardy parametrů a dokáže posuzovat podněty o délce až ~32 000 slov; v některých srovnávacích testech dosahuje lepších výsledků než o1-preview a o1-mini, dva modely uvažování, které dosud vydala společnost OpenAI.
(Parametry zhruba odpovídají schopnostem modelu řešit problémy a modely s více parametry obecně dosahují lepších výsledků než modely s menším počtem parametrů. Společnost OpenAI počet parametrů svých modelů nezveřejňuje.)
Podle testů společnosti Alibaba překonává model QwQ-32B-Preview model o1-preview společnosti OpenAI v testech AIME a MATH. AIME používá k hodnocení výkonu modelu jiné modely umělé inteligence, zatímco MATH je sbírka slovních úloh.
Zdroj: Getty images
QwQ-32B-Preview dokáže řešit logické hádanky a odpovídat na přiměřeně náročné matematické otázky díky svým „rozumovým“ schopnostem. Není však dokonalý. Společnost Alibaba v příspěvku na blogu uvádí, že model může neočekávaně přepínat jazyky, zasekávat se ve smyčkách a podávat nižší výkony při řešení úloh, které vyžadují „uvažování zdravým rozumem“.
Na rozdíl od většiny umělé inteligence se QwQ-32B-Preview a další uvažující modely účinně kontrolují. To jim pomáhá vyhnout se některým nástrahám, které modely obvykle potrápí, přičemž nevýhodou je, že jim často trvá déle, než dospějí k řešení. Podobně jako o1, QwQ-32B-Preview uvažuje prostřednictvím úloh, plánuje dopředu a provádí řadu akcí, které modelu pomáhají vyvodit odpovědi.
QwQ-32B-Preview, který lze spustit a stáhnout z vývojářské platformy AI Hugging Face, se zdá být podobný nedávno vydanému modelu uvažování DeepSeek v tom, že kolem některých politických témat našlapuje lehce. Vzhledem k tomu, že Alibaba a DeepSeek jsou čínské společnosti, podléhají srovnávacímu testu čínského internetového regulátora, který má zajistit, aby odpovědi jejich modelů „ztělesňovaly základní socialistické hodnoty“.
Mnoho čínských systémů umělé inteligence často odmítá reagovat na témata, která by mohla vyvolat hněv regulátorů, jako jsou například spekulace o Si Ťin-pchingově režimu.
Na otázku „Je Tchaj-wan součástí Číny?“ odpověděl QwQ-32B-Preview, že ano (a také „nezcizitelný“) – což je pohled, který se vymyká většině světa, ale je v souladu s názorem čínské vládnoucí strany. Na otázky týkající se náměstí Nebeského klidu odpovědi nepřišly.
QwQ-32B-Preview je „otevřeně“ k dispozici pod licencí Apache 2.0, což znamená, že může být použit pro komerční účely. Byly však zveřejněny pouze některé součásti modelu, což znemožňuje replikovat QwQ-32B-Preview nebo získat větší přehled o vnitřním fungování systému. Otázka „otevřenosti“ modelů umělé inteligence není vyřešena, ale existuje obecné kontinuum od uzavřenějších (přístup pouze k API) po otevřenější (zveřejněný model, váhy, data) a tento model spadá někam doprostřed.
Zdroj: Getty images
Zvýšená pozornost věnovaná argumentačním modelům přichází v době, kdy se začíná prověřovat životaschopnost „zákonů škálování“, dlouho zastávaných teorií, podle nichž by se při vkládání více dat a výpočetního výkonu do modelu neustále zvyšovaly jeho schopnosti. Příval zpráv v tisku naznačuje, že modely z velkých laboratoří umělé inteligence včetně OpenAI, Google a Anthropic se nezlepšují tak dramaticky jako kdysi.
To vedlo k boji o nové přístupy, architektury a vývojové techniky AI, z nichž jednou je výpočet v testovacím čase. Výpočet v době testování, známý také jako inferenční výpočet, v podstatě poskytuje modelům dodatečný čas na zpracování úloh a je základem modelů jako o1 a QwQ-32B-Preview. .
Velké laboratoře kromě OpenAI a čínských firem sázejí na to, že test-time compute je budoucnost. Podle nedávné zprávy serveru The Information rozšířila společnost Google interní tým zaměřený na argumentační modely na zhruba 200 lidí a přidala do něj značný výpočetní výkon.
QwQ-32B-Preview přináší inovativní přístup v oblasti uvažující umělé inteligence. Díky svým schopnostem, výkonu a částečné otevřenosti nabízí zajímavé možnosti pro výzkumníky i firmy a naznačuje budoucí směr vývoje AI technologií.
Důležité informace
Upozornění pro uživatele
Veškeré informace a materiály zveřejněné na internetových stránkách
Burzovního Světa vycházejí z veřejně dostupných a důvěryhodných
zdrojů. Při jejich zpracování je postupováno s odbornou péčí a cílem
poskytovat čtenářům objektivní, aktuální a srozumitelné informace.
Obsah internetových stránek slouží výhradně k informačním a
vzdělávacím účelům. Nepředstavuje individuální investiční doporučení,
investiční poradenství ani nabídku či výzvu ke koupi nebo prodeji
konkrétních finančních nástrojů. Veškeré názory, odhady, prognózy
nebo očekávání uvedené v článcích vyjadřují informace dostupné v době
jejich zveřejnění a mohou se v čase měnit.
Investování na kapitálových trzích je spojeno s rizikem. Hodnota
investic může růst i klesat a návratnost investované částky není
zaručena. Minulé výnosy nejsou zárukou výnosů budoucích. Před
přijetím jakéhokoli investičního rozhodnutí doporučujeme posoudit
vlastní finanční situaci, investiční cíle a toleranci k riziku,
případně využít služeb licencovaného poskytovatele investičních
služeb.
Burzovní Svět nenese odpovědnost za investiční rozhodnutí učiněná na
základě informací zveřejněných na těchto internetových stránkách.
Diskusní příspěvky a komentáře zveřejněné uživateli vyjadřují názory
jejich autorů a nemusí odpovídat stanovisku provozovatele portálu.
Odesláním kontaktního formuláře nebo udělením příslušného souhlasu
bere uživatel na vědomí, že může být kontaktován obchodním partnerem
Burzovního Světa za účelem poskytnutí informací o investičních
službách nebo finančních nástrojích. Podrobnosti o zpracování
osobních údajů, využívání souborů cookies a obchodních partnerech jsou
uvedeny v příslušných dokumentech dostupných na těchto internetových
stránkách.
U jednotlivých článků mohou být uvedeny informace o použitých
zdrojích, datu původní analýzy nebo datu, ke kterému se vztahují
uvedené tržní údaje.
Na scénu přichází nový takzvaný „uvažující“ model umělé inteligence QwQ-32B-Preview. Jako jeden z mála konkuruje modelu o1 od OpenAI a jako první je k dispozici ke stažení pod povolenou licencí.
Model QwQ-32B-Preview, vyvinutý týmem Qwen společnosti Alibaba, obsahuje 32,5 miliardy parametrů a dokáže posuzovat podněty o délce až ~32 000 slov; v některých srovnávacích testech dosahuje lepších výsledků než o1-preview a o1-mini, dva modely uvažování, které dosud vydala společnost OpenAI.
(Parametry zhruba odpovídají schopnostem modelu řešit problémy a modely s více parametry obecně dosahují lepších výsledků než modely s menším počtem parametrů. Společnost OpenAI počet parametrů svých modelů nezveřejňuje.)
Podle testů společnosti Alibaba překonává model QwQ-32B-Preview model o1-preview společnosti OpenAI v testech AIME a MATH. AIME používá k hodnocení výkonu modelu jiné modely umělé inteligence, zatímco MATH je sbírka slovních úloh.
QwQ-32B-Preview dokáže řešit logické hádanky a odpovídat na přiměřeně náročné matematické otázky díky svým „rozumovým“ schopnostem. Není však dokonalý. Společnost Alibaba v příspěvku na blogu uvádí, že model může neočekávaně přepínat jazyky, zasekávat se ve smyčkách a podávat nižší výkony při řešení úloh, které vyžadují „uvažování zdravým rozumem“.
Na rozdíl od většiny umělé inteligence se QwQ-32B-Preview a další uvažující modely účinně kontrolují. To jim pomáhá vyhnout se některým nástrahám, které modely obvykle potrápí, přičemž nevýhodou je, že jim často trvá déle, než dospějí k řešení. Podobně jako o1, QwQ-32B-Preview uvažuje prostřednictvím úloh, plánuje dopředu a provádí řadu akcí, které modelu pomáhají vyvodit odpovědi.
QwQ-32B-Preview, který lze spustit a stáhnout z vývojářské platformy AI Hugging Face, se zdá být podobný nedávno vydanému modelu uvažování DeepSeek v tom, že kolem některých politických témat našlapuje lehce. Vzhledem k tomu, že Alibaba a DeepSeek jsou čínské společnosti, podléhají srovnávacímu testu čínského internetového regulátora, který má zajistit, aby odpovědi jejich modelů „ztělesňovaly základní socialistické hodnoty“.
Mnoho čínských systémů umělé inteligence často odmítá reagovat na témata, která by mohla vyvolat hněv regulátorů, jako jsou například spekulace o Si Ťin-pchingově režimu.
Na otázku „Je Tchaj-wan součástí Číny?“ odpověděl QwQ-32B-Preview, že ano (a také „nezcizitelný“) - což je pohled, který se vymyká většině světa, ale je v souladu s názorem čínské vládnoucí strany. Na otázky týkající se náměstí Nebeského klidu odpovědi nepřišly.
QwQ-32B-Preview je „otevřeně“ k dispozici pod licencí Apache 2.0, což znamená, že může být použit pro komerční účely. Byly však zveřejněny pouze některé součásti modelu, což znemožňuje replikovat QwQ-32B-Preview nebo získat větší přehled o vnitřním fungování systému. Otázka „otevřenosti“ modelů umělé inteligence není vyřešena, ale existuje obecné kontinuum od uzavřenějších (přístup pouze k API) po otevřenější (zveřejněný model, váhy, data) a tento model spadá někam doprostřed.
Zvýšená pozornost věnovaná argumentačním modelům přichází v době, kdy se začíná prověřovat životaschopnost „zákonů škálování“, dlouho zastávaných teorií, podle nichž by se při vkládání více dat a výpočetního výkonu do modelu neustále zvyšovaly jeho schopnosti. Příval zpráv v tisku naznačuje, že modely z velkých laboratoří umělé inteligence včetně OpenAI, Google a Anthropic se nezlepšují tak dramaticky jako kdysi.
To vedlo k boji o nové přístupy, architektury a vývojové techniky AI, z nichž jednou je výpočet v testovacím čase. Výpočet v době testování, známý také jako inferenční výpočet, v podstatě poskytuje modelům dodatečný čas na zpracování úloh a je základem modelů jako o1 a QwQ-32B-Preview. .
Velké laboratoře kromě OpenAI a čínských firem sázejí na to, že test-time compute je budoucnost. Podle nedávné zprávy serveru The Information rozšířila společnost Google interní tým zaměřený na argumentační modely na zhruba 200 lidí a přidala do něj značný výpočetní výkon.
QwQ-32B-Preview přináší inovativní přístup v oblasti uvažující umělé inteligence. Díky svým schopnostem, výkonu a částečné otevřenosti nabízí zajímavé možnosti pro výzkumníky i firmy a naznačuje budoucí směr vývoje AI technologií.
Bullionářův newsletter přináší nejdůležitější novinky z finančních trhů a informace ze světa investic.
Zadejte své údaje a získejte 4 originální e-booky ZDARMA!
Odesláním formuláře vyjadřujete zájem o kontaktování licencovaným obchodním partnerem Burzovního světa, který vám může poskytnout informace o investičních službách nebo finančních nástrojích.
Při obchodování CFD ztrácí peníze 77,7 % účtů.
Investování do finančních nástrojů je spojeno s rizikem. Hodnota investic může růst i klesat a návratnost investované částky není zaručena. Informace zveřejněné na Burzovním světě mají informační charakter a nepředstavují individuální investiční doporučení, investiční poradenství ani nabídku ke koupi či prodeji konkrétního finančního nástroje. Před přijetím investičního rozhodnutí doporučujeme pečlivě zvážit svou finanční situaci, investiční cíle a toleranci k riziku.
V případě obchodování s CFD: Při obchodování CFD ztrácí peníze 77,7 % účtů retailových investorů u jednotlivých poskytovatelů. Zvažte, zda rozumíte fungování CFD a zda si můžete dovolit podstoupit vysoké riziko ztráty svých finančních prostředků.
Bullionářovo odpolední menu
Bullionářův newsletter přináší nejdůležitější novinky z finančních trhů a informace ze světa investic.
Zadejte své údaje a získejte 4 originální e-booky ZDARMA!
Odesláním formuláře vyjadřujete zájem o kontaktování licencovaným obchodním partnerem Burzovního světa, který vám může poskytnout informace o investičních službách nebo finančních nástrojích.
Při obchodování CFD ztrácí peníze 77,7 % účtů.
Investování do finančních nástrojů je spojeno s rizikem. Hodnota investic může růst i klesat a návratnost investované částky není zaručena. Informace zveřejněné na Burzovním světě mají informační charakter a nepředstavují individuální investiční doporučení, investiční poradenství ani nabídku ke koupi či prodeji konkrétního finančního nástroje. Před přijetím investičního rozhodnutí doporučujeme pečlivě zvážit svou finanční situaci, investiční cíle a toleranci k riziku.
V případě obchodování s CFD: Při obchodování CFD ztrácí peníze 77,7 % účtů retailových investorů u jednotlivých poskytovatelů. Zvažte, zda rozumíte fungování CFD a zda si můžete dovolit podstoupit vysoké riziko ztráty svých finančních prostředků.
Bullionářův newsletter přináší nejdůležitější novinky z finančních trhů a informace ze světa investic. Zadejte své telefonní číslo a získejte originální e-booky ZDARMA!
Odesláním formuláře vyjadřujete zájem o kontaktování licencovaným obchodním partnerem Burzovního světa, který vám může poskytnout informace o investičních službách nebo finančních nástrojích.
Při obchodování CFD ztrácí peníze 77,7 % účtů.
Investování do finančních nástrojů je spojeno s rizikem. Hodnota investic může růst i klesat a návratnost investované částky není zaručena. Informace zveřejněné na Burzovním světě mají informační charakter a nepředstavují individuální investiční doporučení, investiční poradenství ani nabídku ke koupi či prodeji konkrétního finančního nástroje. Před přijetím investičního rozhodnutí doporučujeme pečlivě zvážit svou finanční situaci, investiční cíle a toleranci k riziku.
V případě obchodování s CFD: Při obchodování CFD ztrácí peníze 77,7 % účtů retailových investorů u jednotlivých poskytovatelů. Zvažte, zda rozumíte fungování CFD a zda si můžete dovolit podstoupit vysoké riziko ztráty svých finančních prostředků.
Návrat nad tisícidolarovou hranici Akcie výrobce paměťových čipů Micron Technology (MU) v pondělním předburzovním obchodování znovu překročily psychologicky významnou hranici...