Nvidia представила метод спекулятивного декодирования, который ускоряет LLM на 30% без снижения точности.