Muse Glimmer, A 30B parameter dense model swallowing a...

Alok's profile picture

Alok

65,480 Aufrufe • vor 1 Monat

Qwen 3.8 27B (dense) running on a single RTX...

Alok's profile picture

Alok

383,369 Aufrufe • vor 1 Monat

50% more context unlocked for Qwen 3.8 27b Q4_K_XL...

Alok's profile picture

Alok

39,189 Aufrufe • vor 26 Tagen

Qwen 3.8 27B Q4_K_M - 90 tokens/sec on a...

Alok's profile picture

Alok

105,388 Aufrufe • vor 28 Tagen

If you thought the Gemma 4 31B (dense) model...

Alok's profile picture

Alok

40,993 Aufrufe • vor 1 Monat

The "I don't have enough VRAM" excuse just died....

Alok's profile picture

Alok

19,370 Aufrufe • vor 1 Monat

Gemma 4 26B A4B MoE - 500+ t/s decode...

Alok's profile picture

Alok

17,465 Aufrufe • vor 1 Monat

Gemma 4 12B QAT (dense) achieves 1000+ tokens/sec prefill...

Alok's profile picture

Alok

34,500 Aufrufe • vor 3 Monaten

Open source AI is actually moving at an unhinged...

Alok's profile picture

Alok

26,841 Aufrufe • vor 3 Monaten

the 24gb vram tier is enough for most builder...

Sudo su's profile picture

Sudo su

19,576 Aufrufe • vor 4 Monaten

I told you to claim your free 16GB NVIDIA...

Alok's profile picture

Alok

170,442 Aufrufe • vor 2 Monaten

you're paying $20/mo for something your $500 GPU can...

Alok's profile picture

Alok

36,691 Aufrufe • vor 2 Monaten

Run Gemma 4 26b MTP on 8 GB VRAM...

Alok's profile picture

Alok

200,913 Aufrufe • vor 3 Monaten

Run Gemma 4 26B MoE on 8GB VRAM with...

Alok's profile picture

Alok

292,770 Aufrufe • vor 3 Monaten

my 8 GB VRAM gaming laptop is absolutely going...

Alok's profile picture

Alok

63,689 Aufrufe • vor 3 Monaten

90% of "AI developers" just download pre packaged GGUF...

Alok's profile picture

Alok

62,631 Aufrufe • vor 2 Monaten

If you have an RTX 3090 or 4090, Mia...

Yume_X's profile picture

Yume_X

38,685 Aufrufe • vor 13 Tagen

Qwen3.8-Flash-Next now reaches ~43 tok/s after a 122,902-token prompt...

Cruz's profile picture

Cruz

12,258 Aufrufe • vor 8 Tagen

I just got Gemma 4 26B A4B MoE model...

Alok's profile picture

Alok

105,094 Aufrufe • vor 2 Monaten

Free NVIDIA GPU with 16 GB VRAM GPU for...

Alok's profile picture

Alok

182,483 Aufrufe • vor 2 Monaten

llama.cpp isn't just for text LLMs anymore. Pure C++...

Alok's profile picture

Alok

47,881 Aufrufe • vor 1 Monat