Загрузка видео...

Не удалось загрузить видео

На главную

DeepSeek v4.1 Flash via API is almost TOO fast 🤯

137,788 просмотров • 6 дней назад •via X (Twitter)

Комментарии: 46

Фото профиля keys 🧪
keys 🧪6 дней назад

Actually don’t want the model to run too fast then you have keep scrolling up to see what happened it’s annoying after a while

Фото профиля Mia
Mia6 дней назад

Good problem to have imo

Фото профиля hkdom
hkdom6 дней назад

You will wow more if you run it with DSH

Фото профиля Mia
Mia6 дней назад

You're probably right

Фото профиля Santanu Sinha
Santanu Sinha6 дней назад

Genuine question.. what harness is that and why is it flickering so much? Also .. yes amazing speed

Фото профиля Mia
Mia6 дней назад

Hermes agent CLI

Фото профиля Santanu Sinha
Santanu Sinha6 дней назад

Ok thanks

Фото профиля kaith
kaith6 дней назад

How’s it’s performance?

Фото профиля Mia
Mia6 дней назад

Looking better than v4 flash

Фото профиля Consigliere
Consigliere6 дней назад

via Cloud API?

Фото профиля Mia
Mia6 дней назад

Yes

Фото профиля Gaurav Bhatia
Gaurav Bhatia6 дней назад

Imagine after thinking for that long it doesn’t complete the work.

Фото профиля Mia
Mia6 дней назад

But it did 😀

Фото профиля Wassollichhier
Wassollichhier6 дней назад

is vision onboard?

Фото профиля Mia
Mia6 дней назад

Not on this one, it's beta

Фото профиля Samuel McHargue
Samuel McHargue6 дней назад

@grok how much is v4.1 flash compared to the older one.

Фото профиля Bear
Bear6 дней назад

Vision support?

Фото профиля Daniel Carneiro
Daniel Carneiro6 дней назад

WTF is that ugly TUI?

Фото профиля nah
nah6 дней назад

Imagine every model being this fast. That'd be amazing.

Фото профиля Steven Cheng
Steven Cheng6 дней назад

Latency that low feels like cheating.

Фото профиля base
base6 дней назад

get in my spark … lol

Фото профиля CV.YH
CV.YH6 дней назад

Wow

Фото профиля Chris Winslow
Chris Winslow6 дней назад

Speed ≠ Quality?

Фото профиля Saurav
Saurav6 дней назад

actually useful?

Фото профиля Mia
Mia6 дней назад

Seems like it's better than v4 flash

Фото профиля bitflipgremlin
bitflipgremlin6 дней назад

this isn't quite mercury-2 speed but it's damn fucking close, and quality leads me to suspect it's a different mechanism. i wonder what kind of bullshit the whale came up with now

Фото профиля Ian Hailey
Ian Hailey6 дней назад

It can never be too fast!

Фото профиля dan0mad
dan0mad6 дней назад

There’s 4.1???!? Since wen?

Фото профиля forreal
forreal6 дней назад

better than glm 5.3 flash? it only matters if it reaches performance of kimi k3 or glm 5.3.

Фото профиля Devin Oldenburg
Devin Oldenburg6 дней назад

~176 tokens/sec

Фото профиля Redmix
Redmix6 дней назад

It's a shame we can't enjoy it for very long.

Фото профиля Mia
Mia6 дней назад

Squeezing what I can !

Фото профиля Redmix
Redmix6 дней назад

✌🏻

Фото профиля Cato Nooka
Cato Nooka6 дней назад

if there is another model break through for this kind of speed, I don't know what to say, not only so fast at 400 TPS, but also more token efficient, the time for each task is shink down to minutes

Фото профиля Yume_X
Yume_X6 дней назад

Yeah I was shocked too when I saw it , makes a good argument for 300 tok/s builds when you see it lol

Фото профиля CryptoYeti
CryptoYeti6 дней назад

@grok wie teuer ist die API von der neuste Model von Deepseek? Und vergleiche sie mit Muse spark corbitor .

Фото профиля Jayden
Jayden6 дней назад

The latency is fun. The bill is the actual benchmark.

Фото профиля Mike
Mike6 дней назад

I really wish Nous would fix the CLI redraw flashing in Hermes. That’s mainly why I stick to the TUI.

Фото профиля remakw
remakw6 дней назад

fastest model i gave ever used switched the trace off because my eyes were hurting lol

Фото профиля rapidTools / Mike
rapidTools / Mike6 дней назад

o_0... Dafuq... I hope we get this open as well. It would speed up local flash model az well I guess. (not to this speed obviously, but making it even faster wpuld be cool)

Фото профиля Tom
Tom6 дней назад

Why I only see v40730? Where is 4.1?

Фото профиля Steven Cheng
Steven Cheng6 дней назад

Almost" is doing a lot of heavy lifting there. Latency spikes still kill the vibe when you are chaining calls.

Фото профиля Reelix
Reelix6 дней назад

Do a speed comparison :p

Фото профиля Cave
Cave6 дней назад

Woo.

Фото профиля Jarno
Jarno6 дней назад

Fast until you hit the rate limit, then it's back to staring at a spinner like every other model.

Фото профиля Akshay Joshi
Akshay Joshi6 дней назад

Thought it’s free and went rampant and burned 96million token from Deekseek platform hopefully 97% cache hit hence 1.30$ only

Похожие видео