Přejít k hlavnímu obsahu
Obrázek
Ilustrační obrázek pro jarvis-ai.cz

Otestovali jsme: Qwen3.8 běží o 69 % rychleji po zapnutí jediného parametru

V llama.cpp je u modelu Qwen3.8-27B ukrytá funkce, která umí předvídat další tokeny dopředu. Většina lidí ji ale nikdy nezapne, protože ji knihovna bez explicitního přepínače tiše ignoruje. Přicházejí tak o třetinu až dvě třetiny rychlosti zadarmo. Při ověření na dvou grafických kartách se rychlost generování po zapnutí jediného parametru zvedla o 69 procent — z 15,9 na 26,8 tokenu za sekundu. Žádný nový model, žádná konverze, žádný poplatek.
17. 8. 2026 Daniel Česák
Obrázek
Ilustrační obrázek

DynamoDB umí hledat podle významu. AWS odstranilo jeden důležitý mezikrok pro AI aplikace

AWS přidalo do Amazon DynamoDB nativní vektorové vyhledávání. Záznamy s embeddingy lze nyní hledat podle podobnosti přímo v databázi, která zároveň uchovává běžná provozní data. Vývojáři tak mohou v řadě scénářů vynechat samostatnou vektorovou databázi, OpenSearch i část synchronizační infrastruktury.

DynamoDB už nehledá jen přesný klíč

Amazon DynamoDB je cloudová NoSQL databáze určená především pro aplikace, které potřebují rychle ukládat a načítat data bez správy serverů.

17. 8. 2026 Daniel Česák
Obrázek
Ilustrační obrázek

DeepSeek otevírá stavebnici pro AI agenty. Harness odděluje model od nástrojů i kontroly

DeepSeek zveřejnil DeepSeek Harness, otevřený základ pro stavbu a provoz AI agentů. Nejde o další chatbot ani o nový jazykový model. Harness řeší méně viditelnou, ale zásadní část systému: jak agent používá nástroje, pracuje se soubory, pamatuje si průběh úkolu a bezpečně pokračuje v práci. Projekt je v developer preview, má MIT licenci a každá jeho hlavní část funguje jako vyměnitelný plugin.

V posledních měsících se kolem AI agentů mluví hlavně jako o samostatných digitálních pracovnících. Samotný model ale agentem ještě není.

17. 8. 2026 Daniel Česák
Obrázek
Ilustrační obrázek

ChatGPT otevře obří konverzaci 16× rychleji. A sám si vybere, který model co spočítá

OpenAI tento týden potichu přepracovala, jak se ChatGPT a Codex chovají „pod kapotou". Konverzace o 741 zprávách, která se dřív otevírala 27,6 sekundy, teď naběhne za 1,66 sekundy. A v Codexu je nyní dostupný Multi-Agent v2, který sám rozhoduje, který model co spočítá — bez nutnosti ručně přepínat mezi Sol, Terra a Luna.

16× rychleji? Ano, ale ne tak, jak zní titulek

Nejdřív upřesním jedno číslo, které se v titulcích objevilo a je trochu zavádějící.

17. 8. 2026 Miriam Česáková
Obrázek
Ilustrační obrázek

Soudce potrestal žalobce za skryté instrukce pro AI. Prompt injection dorazil k soudu

Žalobce z Connecticutu ukryl do soudních podání instrukce určené umělé inteligenci. Text napsal bílou barvou na bílém pozadí a doufal, že ho člověk neuvidí, zatímco jazykový model ano. Soud žádný AI systém pro hodnocení podání nepoužíval. Přesto případ skončil sankcí: Matthew Elliott přišel o možnost podávat dokumenty elektronicky a musí je nově odevzdávat osobně v papírové podobě.

Skrytý text měl přesvědčit AI, aby stála na straně žalobce

Případ se odehrál u soudu v americkém Connecticutu.

17. 8. 2026 Daniel Česák
Obrázek
Ilustrační obrázek

Deepfake australského premiéra připravil oběti o 7,4 milionu dolarů. Podvodníci prodávají důvěru

Australané podle tamního regulátora přišli o 7,4 milionu australských dolarů (AUD) v podvodech, které zneužívaly jména a podobizny známých osobností. Nejčastěji se v nich objevoval deepfake premiéra Anthonyho Albaneseho. Podvodníci pomocí upraveného videa slibovali rychlé zbohatnutí a vydávali falešnou investiční platformu za oficiální projekt podporovaný vládou.

Na první pohled to může vypadat jako obyčejná reklama na sociální síti. Známý politik mluví do kamery, v pozadí se objevují grafy a čísla, web působí profesionálně.

17. 8. 2026 Daniel Česák
Obrázek
Ilustrační foto

Qwen3.8-27B: otestovali jsme 27miliardový model na 16GB grafice. Vejde se jen s druhou kartou

Qwen3.8-27B je nový 27miliardový model od Alibaby, který v sobě spojuje dvě věci najednou: rozumí obrázkům i videu a zároveň je laděný na programování a dlouhé agentní úlohy. My jsme ho otestovali na vlastním hardwaru — na 16GB grafice se v této konfiguraci nevešel, ale s druhou, starší kartou už běžel rychlostí 15 tokenů za sekundu. Změřili jsme reálný výkon konkrétní sestavy, ne obecnou rychlost modelu ani marketingové slajdy.
17. 8. 2026 Daniel Česák
Subscribe to AI
X

Nezmeškejte novinky!

Přihlaste se k odběru novinek a aktualit.