Laya · rozhodnutí za desítky milisekund

Mluv česky. Přepis → typované rozhodnutí → akce. Bez generování textu, jeden průchod enkodérem.
připojuji…
ms
round-trip
medián
min
0rozhodnutí
Závod: poslední rozhodnutí
laya · lokálně
táž laya na MacBooku M4 (MPS)
generativní LLM přes API
Oranžový pruh běží přesně tolik ms, kolik trvalo tohle rozhodnutí. Modrý je naměřená hodnota téhož modelu a téhož schématu na MacBooku M4 přes MPS — tenhle server jede na 4 vCPU bez GPU, a to je na encoderu rozdíl zhruba 5–10×. Šedý pruh je ilustrační referenční hodnota 800 ms pro generativní LLM API, ne měření.
Třídírna · poznámky zákazníků padají do skluzů
0🥂 křehké
0❄️ chlazené
0🎁 dárkové
0⚡ expres
zásilek / s
rozhodnutí / s
medián ms
celkem ms
tentýž nápor přes LLM API*
Data · každá zásilka a jak ji model vyhodnotil
#Poznámka (vstup)SkluzRozdělení pravděpodobnostíconfnoul zásahms
Spusť nápor a data se objeví tady. Klikni na řádek pro celou odpověď modelu.
*Sloupec s LLM je přepočet referenčních 800 ms na zásilku — ilustrace, ne měření. Histogram ukazuje skutečnou latenci jednotlivých rozhodnutí v pořadí, jak proběhla. Kliknutím na řádek rozbalíš surovou odpověď modelu včetně všech pravděpodobností.
Poctivá poznámka ke kvalitě: model běží zero-shot, bez dotrénování. Naměřeno na těchto schématech: skluzy ve třídírně ~75 %, manévry auta ~75 % (12/16). Když sáhne vedle, uvidíš to na pruzích pravděpodobností — a ne vždy to pozná i podle nízké confidence. Demo ukazuje latenci, ne přesnost.