Přeskočit na obsah
Tech-Blog Chatujme.cz Chatujme.cz

Štítek: inference

Umělá inteligence ·

vLLM 0.31.0 odmítá multimodální volby z požadavku, dokud je server výslovně nepovolí

Vydání 0.31.0 z 5. října 2026 odmítne pole mm_processor_kwargs a media_io_kwargs, pokud je klient pošle v požadavku. Dala se jimi předepsat práce s obrázky a videem a u dvou backendů stačilo pár desítek bajtů JSONu na několikanásobek paměti serveru. Kdo ta pole potřebuje, spustí server s přepínačem --trust-request-mm-kwargs.

Umělá inteligence CVE Bezpečnost multimodální modely