Загрузка видео...

Не удалось загрузить видео

На главную

Guess the tok/s

17,255 просмотров • 3 дней назад •via X (Twitter)

Комментарии: 36

Фото профиля Sufyan
Sufyan3 дней назад

500

Фото профиля Miyuru
Miyuru3 дней назад

locking in 900. now tell me the model and how many cards are coughing up smoke behind it

Фото профиля Meet Limbani
Meet Limbani3 дней назад

i know that scrolling speed in PI, it's around 350

Фото профиля Gil
Gil3 дней назад

750

Фото профиля Neo
Neo3 дней назад

420

Фото профиля 0xSero
0xSero3 дней назад

420.69

Фото профиля Decatalyst 🌱
Decatalyst 🌱3 дней назад

OH MY TOMATOES I FEEL LIKE A CAVEMAN USING OPUS 5 NOW 😭

Фото профиля ruleryak
ruleryak3 дней назад

went from 24k output at 7s to 44k output at 34s so end to end throughput including tool calls, prefill, and decode is around 750 tps there. So the actual decode is probably 1k+

Фото профиля Maciej
Maciej3 дней назад

No tool call streaming? They spend bilions on hardware and lack money for API software.

Фото профиля Valentin Yanakiev
Valentin Yanakiev3 дней назад

384

Фото профиля D
D3 дней назад

450

Фото профиля pythongiant
pythongiant3 дней назад

a majillion

Фото профиля PaulNL
PaulNL3 дней назад

400ish ?

Фото профиля Mike Reese
Mike Reese3 дней назад

How does cerebras compare to your local setup with deepseek 4.1 flash in terms of tok/s?

Фото профиля AArchimedes64
AArchimedes643 дней назад

1024

Фото профиля cherki
cherki3 дней назад

How?

Фото профиля Arman
Arman3 дней назад

1337

Фото профиля Fraser Price
Fraser Price3 дней назад

Bout tree fiddy

Фото профиля Crispybits || Parroty account
Crispybits || Parroty account3 дней назад

3 - you've sped up the AI writing sections of the video 1000x 😹

Фото профиля Redmix
Redmix3 дней назад

~1850

Фото профиля Wayne
Wayne3 дней назад

I bet that's at least 1t/s

Фото профиля Serhii Y.
Serhii Y.3 дней назад

you're typing 1-2tts, model 100+

Фото профиля mo
mo3 дней назад

320

Фото профиля Kutluk
Kutluk3 дней назад

~300-400?

Фото профиля Jason Frisch
Jason Frisch3 дней назад

What do I need to run GLM-5.3-flash? Can a Mac Studio manage it for regular coding tasks?

Фото профиля Loco Legend
Loco Legend3 дней назад

170-250

Фото профиля Sektur Toilet
Sektur Toilet3 дней назад

3-400?

Фото профиля Jeff Steve
Jeff Steve3 дней назад

700

Фото профиля Simao Soares 🇪🇺🇵🇹🇳🇱
Simao Soares 🇪🇺🇵🇹🇳🇱3 дней назад

I've seen a tok/s, is there a metric for token quality? I'm honestly curious. So many tools to reduce token usage like context compression, context understanding, prompt engineering for summarised high quality replies, MTP and non-MTP...

Фото профиля saltyclaw707
saltyclaw7073 дней назад

300 ish

Фото профиля vveerrgg
vveerrgg3 дней назад

280 T/Sec. … how are you configuring your cards … that’s the question I have

Фото профиля Petey struggles
Petey struggles3 дней назад

1500

Фото профиля Matt
Matt3 дней назад

700+

Фото профиля Asif Sheikh 💸
Asif Sheikh 💸3 дней назад

~1,850 tokens/s you're welcome.

Фото профиля byovd
byovd3 дней назад

300

Фото профиля Kachow Towmater
Kachow Towmater3 дней назад

280

Похожие видео