Dynamic-dLLM: в 3 раза быстрее — новый способ ускорить работу диффузионных LLM
Dynamic-dLLM ускоряет работу диффузионных LLM более чем в 3 раза за счёт динамического обновления кэша и адаптивного декодирования. Протестировано на LLaDA и Dream, в системах MMLU, GSM8K, HumanEval.