Video yükleniyor...

Video Yüklenemedi

Ana Sayfaya Dön

Up to 3x faster LLM generation with no extra resources/requirements - ngram speculation has landed in 🤗 transformers! 🏎️💨 All you need to do is to add `prompt_lookup_num_tokens=10` to your `generate` call and you'll get faster LLMs🔥 🧵How does it work?

107,778 görüntüleme • 2 yıl önce •via X (Twitter)

0 Yorum

Yorum bulunmuyor

Orijinal gönderinin yorumları burada görünecek

Benzer Videolar