
Liquid AI objavio nacrtne modele koji kraćaju odziv poziva alata za 57 odsto
DSpark kontrolne tačke dodaju spekulativno dekodiranje trima modelima iz porodice LFM2.5. Liquid AI navodi do 3,18 puta veći protok na grafičkoj kartici i 2,87 puta na uređaju, uz nepromijenjen kvalitet izlaza, i podršku za llama.cpp i SGLang od prvog dana.
Hugging Faceprovjereno
