Blog

  • Nový model – Kimi K3

    Čínský startup Moonshot AI předvedl obrovský skok na poli otevřené umělé inteligence a představil Kimi K3. Jedná se o masivní model s 2,8 bilionu parametrů, který přináší kontextové okno o velikosti 1 milionu tokenů a pokročilé multimodální schopnosti včetně vizuálního uvažování. To, co ale vývojářskou komunitu zasáhlo nejvíce, jsou jeho výsledky. V nezávislých benchmarcích (jako je například Arena.AI) se model dokáže sebevědomě vyrovnat, a v některých případech dokonce i překonat, špičkové proprietární modely jako jsou Claude Fable 5 nebo GPT-5.6 Sol. Společnost navíc slíbila brzké a kompletní uvolnění vah modelu pro veřejnost. 

    Zdroj:

    • https://www.kimi.com/blog/kimi-k3

    Komentář:

    • Model, který svými reálnými vlastnostmi dosahuje na prémiovou kvalitu Fable, na API stojí přibližně tolik, co Claude Sonnet, a přitom je díky uvolněným vahám celý zdarma k provozu on-premise… tomu říkám pořádná konkurence. Tento krok jasně ukazuje, že otevřená scéna dokáže nabídnout absolutně špičkový výkon a narušit dominanci uzavřených komerčních modelů. Pro všechny, kteří chtějí výkonnou AI a zároveň potřebují držet svá data v bezpečí na vlastním hardwaru, je to fantastická zpráva. 
  • Pořádná kvantizace (binární)

    Výzkumníci z PrismML nedávno představili zajímavý technologický posun, který detailně popisují ve svém whitepaperu k modelu Bonsai-27b. Zaměřují se v něm na extrémní – konkrétně binární (1bitovou) – kvantizaci velkých jazykových modelů. Zatímco standardní modely běžně vyžadují 16bitovou nebo 8bitovou přesnost, binární kvantizace ořezává váhy modelu na naprosté minimum. Tento radikální přístup drasticky snižuje nároky na operační paměť (VRAM) a výpočetní výkon, přičemž cílem je zachovat co největší část původní schopnosti a přesnosti modelu. V praxi to znamená, že se masivní modely dokážou vtěsnat do zlomku původní velikosti. 

    Zdroj:

    • https://github.com/PrismML-Eng/Bonsai-demo/blob/main/bonsai-27b-whitepaper.pdf

    Komentář:

    • Tento směr vývoje je naprosto klíčový. Pokud se hardwarová náročnost na provoz modelu dokáže díky těmto kompresním metodám snížit v obrovských násobcích, otevírá nám to cestu k datové nezávislosti. Je to reálná možnost, jak mít své vlastní, výkonné a zcela soukromé osobní AI dostupné na „jakémkoliv“ lokálním zařízení – ať už jde o běžný notebook nebo do budoucna i mobilní telefon – bez nutnosti neustálého připojení na drahý cloud.
  • Grok poslal celé repozitáře do Xai bucketu

    Nedávno internetem a vývojářskou komunitou otřásla velmi znepokojivá zpráva týkající se AI nástroje Grok od společnosti xAI. Bezpečnostní výzkumníci z CerebLab odhalili a následně úspěšně reprodukovali chování, při kterém vývojářský nástroj grok-build potají odesílal kompletní zdrojové kódy celých repozitářů přímo do cloudových úložišť patřících xAI. Ačkoliv Elon Musk bezprostředně po publikování tohoto zjištění slíbil okamžitou nápravu a důkladnou „čistku“ kódu, samotný incident odkrývá obrovské bezpečnostní riziko spojené s nekontrolovanou integrací AI asistentů do vývojářského prostředí. 

    Zdroj:

    Komentář:

    • Celá tato situace nutí k velmi nepříjemnému zamyšlení: co by se stalo, kdyby se na podobné exfiltrování dat vůbec nepřišlo? A upřímně – můžeme si být jistí, že úplně to samé nedělají (ať už záměrně, nebo chybou v návrhu) i ostatní populární AI nástroje? Spoléhat se na slepou důvěru se dnes prostě nevyplácí. Je naprosto nezbytné proaktivně sledovat a auditovat, co přesně AI nástroje ve vaší síti dělají. Pokud je to jen trochu technicky proveditelné, snažte se je držet v izolovaném prostředí. Ze všeho nejdůležitější je ale přijmout předpoklad „zero trust“ – musíte být od samého začátku procesně i bezpečnostně připraveni na situaci, že se vaše citlivá data a zdrojové kódy jednoho dne ocitnou mimo vaši kontrolovanou infrastrukturu.
  • Propad akcií po IPO: Vystřízlivění pro SpaceX

    Ačkoliv se vesmírná společnost Elona Muska historicky těší obrovskému hypu, její nedávný vstup na burzu (IPO) přinesl i studenou sprchu. Akcie SpaceX (SPCX) po uvedení na trh padají, což vyvolává otázky ohledně reálné valuace společnosti a udržitelnosti jejích masivních plánů z pohledu opatrnějších investorů. Trh aktuálně hledá balanc mezi vizionářským inovačním potenciálem a tvrdou finanční realitou kosmického průmyslu. Ve SpaceX je zahrnuta Xai, která v IPO slibovala masivní tržní potenciál pro AI. 

    Zdroje:

    Komentář:

    • SPCX vstoupilo i  do NASDAQ, takže proběhlo skupování, nicméně se čeká na výsledky společnosti a pak je ohlášena vlna prodejů od prvotních akcionářů. Z mého pohledu bude valuace klesat.
  • „Dvojitá cena“ umělé inteligence: Satya Nadella varuje

    CEO Microsoftu Satya Nadella vydal důrazné varování pro všechny firmy, které plošně nasazují umělou inteligenci. Upozorňuje, že transformace s sebou nese tzv. „dvojitou cenu“. Kromě samotných poplatků za technologie a výpočetní výkon musí společnosti počítat s obrovskými skrytými náklady ve formě uvolnění svého firemního “know how” a duševního vlastnictví směrem k provozovatelům AI modelů. 

    Zdroje:

    Komentář:

    • Řečeno bez příkras. Toto je realita použití modelů jak z USA, tak z Číny. Při adopci AI je klíčové vhodně rozmyslet, kdy na provz nasadit API z USA, nebo z Číny a kdy volit on premise řešení. Lokální open source modely již přinášejí velké příležitosti řešit spousty věcí, bez úniku dat. Nicméně proti snadnému řešení stojí rostoucí cena HW. Problematika dat je klíčová i u coding agents, zde doporučuji používat izolované prostředí i data. 
  • USA zpřísňují postoj k čínským modelům

    Napětí mezi USA a Čínou na poli umělé inteligence nabírá na obrátkách. Američtí zákonodárci začali intenzivně prošetřovat čínské AI modely. Důvodem jsou rostoucí obavy z možného ohrožení národní bezpečnosti, zneužití dat a nedodržování ochrany duševního vlastnictví. Očekává se, že tento politický tlak může brzy vyústit v nová regulatorní omezení, která výrazně zkomplikují čínským AI technologiím přístup na americký a potažmo i evropský trh.

    Zdroje:

    Komentář:

    • V rámci AI stojí Čína a USA proti sobě. Pokud to pro nás, jako spotřebitele znamená zisk otevřených modelů, konkurenčních inovací a levnějších API přístupů, tak je to dobře. Pokud to znamená regulaci a ovlivnění toho zda budu platit násobky za technologii, kterou jsem zvolil, je to pomyslný vykřičník, který je třeba odstranit při návrhu AI infrastruktury, kde musím počítat s možným zásahem regulace.
  • Konec prohlížeče Atlas, ale ne konec ambicí

    Překvapivý tah na šachovnici OpenAI: společnost ruší vývoj svého experimentálního AI prohlížeče Atlas. Podle dostupných informací to ale v žádném případě neznamená, že by firma vzdala snahu ovládnout způsob, jakým konzumujeme web. Naopak, ambice rostou a zdá se, že chytré funkce z Atlasu se postupně integrují přímo do hlubšího ekosystému ChatGPT a dalších budoucích produktů, které změní naše zvyklosti při procházení internetu.

    Zdroje:

    Komentář:

  • Vlastní křemík: OpenAI vyvíjí čip „Jalapeno“

    OpenAI dělá strategický krok směrem k hardwarové nezávislosti. Ve spolupráci se společností Broadcom vyvíjí vlastní inferenční čip s kódovým označením „Jalapeno“. Cílem je radikálně snížit obrovské provozní náklady na běh AI modelů a omezit závislost na externích dodavatelích. Tento vlastní hardware by mohl OpenAI poskytnout kritickou výhodu v efektivitě při nasazování budoucích, ještě náročnějších generací umělé inteligence.

    Zdroj:

    Komentář:

    • Pokud roste konkurence i mezi výrobci čipů může to znamenat levnější inference, kvalitnější služby a lepší ceny. Čína ukazuje, že tento trend funguje.
  • Claude Fable a neustálé posouvání limitů

    Společnost Anthropic u svého modelu Claude Fable tentokrát neposouvá hranice samotné umělé inteligence, ale radikálně mění pravidla pro její využívání. Zásadní novinkou je dočasný přesun modelu do předplacených tarifů (prepaid plans), což bylo překvapivé rozhodnutí. Ruku v ruce s tím jde i posouvání a úprava limitů pro placení z kreditů.

    Zdroj:

    Komentář:

    Posouvání modelu z předplatného do API přístupu a jeho opětovné rušení znamená nestabilitu. Také je vidět konkurenční boj s GPT, kde model Sol stojí proti Fable. Pokud konkurenční boj znamená dostupnost modelů v předplatném, je to pro nás veliké plus. Čekám, že se stejně zapojí čínské firmy. Pokud je to možné, je velice výhodné využívat předplacené tarify (dokud tady jsou).

  • OpenAI představuje GPT-5.6: Sol, Terra a Luna

    OpenAI uvádí na trh novou generaci svých modelů s označením GPT-5.6, která přichází rovnou ve třech variantách – Sol, Terra a Luna. Každý z modelů je optimalizován pro specifické potřeby uživatelů a firem. Zatímco nejrobustnější verze cílí na komplexní a hlubokou analytiku, ty menší se soustředí na bleskovou rychlost. Zkrátka každý si najde to svoje. 

    Zdroj:

    Komentář:

    • Běžný uživatel nepozná, že vyšel nový model, natož aby se o ně zajímal. Z pohledu programátora a vědce mají nové modely nesporné výhody, které se ukazují na složitých úlohách a analýzach opřených o aktulaní stav poznání.