← Zpět na blog

Proč někdo staví čip, který umí jediný model?

Když znáte cíl, nepotřebujete všechny cesty. Univerzální AI vs. specializovaná AI.

O umělé inteligenci dnes platí jedno nevyřčené pravidlo. Nic nevydrží dlouho. Sotva si na nějaký model zvyknete, vyjde novější, chytřejší nebo levnější a vy zvažujete, jestli přejít jinam. A čísla to potvrzují. Podle rozsáhlého průzkumu Databricks mezi více než 20 tisíci organizacemi dnes většina firem nespoléhá na jediný model. Skoro čtyři z pěti používají dva a víc naráz a podíl těch se třemi a více vyskočil z 36 na 59 procent během pouhých tří měsíců. Modely se navíc běžně střídají, často kvůli ceně, a nové vycházejí jeden za druhým, mnohdy několik za jediný měsíc.

Do tohoto překotného vývoje vstupuje jedna kanadská firma s nápadem, který jde přesně naopak. A právě proto stojí za pozornost.

Firma, která jde proti proudu

Firma se jmenuje Taalas, sídlí v Torontu a založil ji Ljubisa Bajic, dřívější inženýr z AMD a Nvidie. Její nápad zní na první pohled protismyslně. Místo univerzálního čipu, do kterého nahrajete jakýkoli model, ona jeden konkrétní model natrvalo vtiskne přímo do křemíku. Váhy modelu se stanou fyzickou součástí čipu a po výrobě se s nimi už nedá hnout.

Proč by to někdo dělal? Kvůli rychlosti a ceně. Běžný AI čip musí neustále přenášet data modelu z paměti a zpátky, což stojí čas i energii. Když je model přímo v křemíku, tenhle přesun odpadá. Taalas u svého prvního čipu (jmenuje se HC1 a umí jediný model, Llamu 3.1 8B od Mety) slibuje mnohonásobně vyšší rychlost a zhruba desetinovou spotřebu energie než běžné řešení na grafických kartách. Na svůj nápad firma zatím získala přes 200 milionů dolarů, takže investoři tomu evidentně věří. A že nejde o okrajovou kuriozitu, naznačuje i to, že se v srpnu 2026 na koupi Taalasu dohodl přímo výrobce čipů AMD. Obchod ještě čeká na schválení a má se uzavřít do konce roku.

Háček je jasný. Takový čip umí jednu jedinou věc. Když se model za pár měsíců změní, zůstane vám drahý a nepoužitelný kus křemíku.

Graf rychlosti inference na modelu Llama 3.1 8B v tokenech za vteřinu na uživatele. Taalas HC1 16 960, Cerebras zhruba 1900, Groq zhruba 600, Nvidia H200 zhruba 230. Čísla dle Taalasu, nezávisle neověřeno.

Ne všechno se musí měnit každý týden

A tady se dostáváme k tomu nejzajímavějšímu. Na první pohled to vypadá jako sázka proti celému trhu, vždyť se přece všechno mění každý týden. Jenže mění se opravdu všechno?

Ne každý systém potřebuje nejnovější model. Spousta věcí, které firmy nasazují, má fungovat pořád stejně a hlavně spolehlivě. Přepis hovorů, třídění dokumentů, jednoduchý asistent na zákaznické lince, překlad, čtení faktur. U takové rutiny nepotřebujete každý měsíc chytřejší nástroj, potřebujete, aby fungoval levně, rychle a bez výpadků, klidně roky v kuse. A přesně tam začíná model napevno v čipu dávat smysl.

Není náhoda, že i lidé z oboru čím dál častěji říkají totéž. O úspěchu nerozhoduje, kdo má nejnovější model, ale kdo dokáže AI spolehlivě zapojit do každodenního provozu. A jakmile se na AI přestanete dívat jako na závod o nejchytřejší mozek, zjistíte, že část vašich systémů se vlastně měnit nemusí. Co se měnit nemusí, to se dá optimalizovat naplno.

Dá se to přirovnat k dopravě. Auto vás sveze kamkoli po každé silnici a dá se přesměrovat, když se cíl změní. Tramvaj jede po pevných kolejích. Mimo ně se nedostane a k ničemu jinému není, zato na té jedné trase odveze víc lidí rychleji, levněji a spolehlivěji než auto a jezdí tak klidně desítky let. Taalas staví pro AI přesně takové tramvaje.

Dvě skupiny, do kterých si AI rozdělit

Pro drtivou většinu z nás je Taalas zatím vzdálená technická kuriozita, žádný čip řešit nebudete a univerzální modely v cloudu vám budou dál bohatě stačit. Ale princip za tím je užitečný i pro malou firmu, i bez jediného čipu.

Rozdělte si nasazení AI do dvou skupin. V první je to, co potřebuje být pořád nejchytřejší a nejnovější, a tam počítejte s tím, že budete průběžně střídat a nemá smysl se do ničeho pevně vázat. Ve druhé je to, co má hlavně spolehlivě fungovat, a tam je stálost výhoda, ne slabina. Čím dřív tenhle rozdíl uvidíte, tím míň energie utratíte za sledování každé novinky u věcí, které to vůbec nepotřebují.

Závěr

Trh se bude vyvíjet dál a nové modely budou vycházet jeden za druhým. Ale ne každý systém tohle tempo potřebuje stíhat. Taalas je zajímavý hlavně jako signál, ukazuje, že AI přestává být jedna velká věc na všechno a začíná se dělit. Na jedné straně univerzální, pružná a věčně se měnící. Na druhé specializovaná, pevně zabudovaná, ale velmi rychlá a levná.

Můj názor? Nenechte se strhnout tempem novinek. Většina toho ruchu se točí kolem toho, kdo má zrovna nejchytřejší model, jenže tam, kde vám AI má hlavně spolehlivě a levně odvádět rutinu, je stálost přednost, ne zaostávání. A vědět, co z vašich věcí patří kam, bude čím dál cennější dovednost.

Máte k tématu názor nebo vlastní zkušenost? Napište mi do komentářů na LinkedIn →

Nevíte, kam ve vaší firmě AI patří a kam ne?

Na školení projdeme vaše reálné procesy a ukážeme, co má smysl průběžně měnit a co nechat běžet spolehlivě. Prakticky, na vašich příkladech.

Nezávazně poptat školení →