Загрузка видео...
Не удалось загрузить видео
Anthropic や OpenAIに 「毎月3万円」支払うことがアホらしくなる Qwen3.6 35B をローカル環境で動かしたら 秒間190トークン前後の速度が出ている このレベルになると もう「AIの返答を待つ」という感覚がほぼない プロンプトを投げた瞬間に文章が流れ出して、 コード生成、要約、翻訳、リライト、壁打ちレベルなら 体感ではほぼリアルタイム。 しかも35Bクラスなので、軽量モデルのように 「速いけど精度が微妙」という感じでもない。 十分に実用レベルの推論力を持ちながら、 手元のマシンで高速に動く。 ここがかなり重要で、 今までは高性能AIを使うなら OpenAIやAnthropicのサブスクに課金して クラウド上のモデルを呼び出すのが当たり前だった。 でも、ローカルLLMがここまで速くなると話が変わる。 月額課金なし。 API制限なし。 レートリミットなし。 混雑による速度低下なし。 会話内容を外部に送らない。 自分のPC上で完結する。 もちろん、GPTやClaudeの最上位モデルにしかできない高度な推論や エージェント作業はまだある。 ただ、日常作業の8割 文章生成、軽いコード、要約、調査メモ、アイデア出しなら ローカルモデルで十分になり始めている。 つまりこれからは、 「AIを使う=月額サブスクに入る」ではなくなる。 OpenAIやAnthropicに課金する人は、 性能だけでなく、UI、安定性、エージェント機能、連携の便利さに 自分で価値を感じて選ぶ時代になる。 ローカルLLMが速すぎるせいで、 AIの選び方そのものが変わり始めてる。
129,113 просмотров • 2 месяцев назад •via X (Twitter)
Комментарии: 0
Нет доступных комментариев
Здесь появятся комментарии из оригинального поста
