BusinessIT 17.09.2026 11:20 DeepSeek-V4.1-Flash využívá 552miliardový MoE model, ale při inferenci aktivuje jen 8 až 16 miliard parametrů. Firma uvádí i výrazně menší nároky na KV cache.

Čítať celý článok >>