Přejít k hlavnímu obsahu
Obrázek
AI agenti a autonomní systémy

Model se vejde do VRAM. Proč s ním ale AI agent nemusí zvládnout projekt

Model se může vejít do VRAM a přesto být pro každodenní programování prakticky nepoužitelný. U lokálního LLM nestačí porovnat velikost GGUF souboru s kapacitou grafické karty. Do stejného rozpočtu se musí vejít také runtime, aktivace modelu, KV cache a pracovní kontext AI agenta. Právě poslední dvě položky vysvětlují, proč může krátký chat fungovat, zatímco otevření většího projektu v OpenCode nebo podobném nástroji skončí nedostatkem paměti.
18. 8. 2026 Daniel Česák
Obrázek
Ilustrační obrázek

GLM 5.3 hledá chyby v kódu téměř jako špičkové modely. Proč ho Z.ai zatím nepouští ven

Čínská společnost Z.ai vydala nový model GLM 5.3, který má podle firemních testů neobvykle silné schopnosti při hledání a zneužívání softwarových zranitelností. Model zatím není volně ke stažení. Z.ai jeho zpřístupnění odložila, aby prověřila bezpečnostní rizika. Důvod je prostý: tentokrát nejde jen o další AI, která umí napsat funkci v Pythonu. GLM 5.3 se podle dostupných výsledků dokáže pustit i do práce, která se běžně spojuje s profesionálními bezpečnostními týmy.
18. 8. 2026 Daniel Česák
Obrázek
Ilustrační obrázek

AI zkracuje kontext, ale může při tom zapomenout vaše pravidla

Umělá inteligence si při dlouhém rozhovoru může začít dělat pořádek v paměti. Starší část konverzace zkrátí do souhrnu, aby se vešla do dostupného kontextu. Jenže podle nové studie při tom často nezmizí hlavní úkol, ale právě drobná pravidla, která uživatel zadal. Výzkumníci naměřili, že po takzvané kompakci přežije v průměru pouze 17 procent těchto instrukcí.

AI si pamatuje úkol, ale zapomene, jak ho má provést

Moderní jazykové modely pracují s takzvaným kontextovým oknem.

18. 8. 2026 Daniel Česák
Obrázek
AI agent s bezpečnostními pravidly a kontrolními mechanismy

AI agenti opouštějí pilotní provoz. Firmy řeší, kdo bude odpovídat za jejich chyby

Firmy už AI agenty nezkoušejí jen v bezpečných pískovištích. Průzkum mezi 200 vedoucími pracovníky ukázal, že téměř 60 procent z nich provozuje autonomní agenty v produkci. Největší otázkou už není, zda agent něco zvládne, ale co smí udělat bez člověka a kdo ponese odpovědnost za chybu.

Od chatbota k nástroji, který může něco změnit

AI agent není jen chatbot, který napíše odpověď. Dostane cíl, umí si rozdělit úkol na kroky a přes připojené nástroje může například spustit test, změnit nastavení cloudu nebo otevřít incident.

18. 8. 2026 Miriam Česáková
Obrázek
Ilustrační obrázek pro jarvis-ai.cz

Otestovali jsme: Qwen3.8 běží o 69 % rychleji po zapnutí jediného parametru

V llama.cpp je u modelu Qwen3.8-27B ukrytá funkce, která umí předvídat další tokeny dopředu. Většina lidí ji ale nikdy nezapne, protože ji knihovna bez explicitního přepínače tiše ignoruje. Přicházejí tak o třetinu až dvě třetiny rychlosti zadarmo. Při ověření na dvou grafických kartách se rychlost generování po zapnutí jediného parametru zvedla o 69 procent — z 15,9 na 26,8 tokenu za sekundu. Žádný nový model, žádná konverze, žádný poplatek.
17. 8. 2026 Daniel Česák
Obrázek
Ilustrační obrázek

DynamoDB umí hledat podle významu. AWS odstranilo jeden důležitý mezikrok pro AI aplikace

AWS přidalo do Amazon DynamoDB nativní vektorové vyhledávání. Záznamy s embeddingy lze nyní hledat podle podobnosti přímo v databázi, která zároveň uchovává běžná provozní data. Vývojáři tak mohou v řadě scénářů vynechat samostatnou vektorovou databázi, OpenSearch i část synchronizační infrastruktury.

DynamoDB už nehledá jen přesný klíč

Amazon DynamoDB je cloudová NoSQL databáze určená především pro aplikace, které potřebují rychle ukládat a načítat data bez správy serverů.

17. 8. 2026 Daniel Česák
Subscribe to AI
X

Nezmeškejte novinky!

Přihlaste se k odběru novinek a aktualit.