Loading video...
Video Failed to Load
Vision RAG の精度と速度が素晴らしいです!Gemini 2.5 Flash と Cohere エンベディング v4 の掛け合わせで、経産省資料(日本語の図解)で試したら完璧でした!いちいちMarkdownなどのテキスト化せずに、この精度と速度が出ています。この精度と速さが出たので、VisionRAG市場が盛り上がりそうです!
71,201 views • 1 year ago •via X (Twitter)
6 Comments

Mojofull1 year ago
早!

Kyutaro@Web x AI x DX1 year ago
これ凄く流行りそうな予感がします😄

MATはAI中学二年生1 year ago
画像を埋め込みにして、加えて画像を保存、テキストで呼び出して埋め込みで検索、検索された画像をGemini 2.5 Flashに渡して答えを得る、ということでしょうか?

Kyutaro@Web x AI x DX1 year ago
今研究中ですがザックリ言うと、画像を保存→ベクトル空間に埋め込み→/→テキストでベクトル検索→画像取得→マルチモーダルで解析→テキスト生成と言う流れだと思います。

Rainmaker2 years ago
Heightened volatility got you on edge? In my latest free Substack post, discover how a Hidden Markov Model (HMM) can help you navigate market corrections and safeguard your investments.

sky20081 year ago
see
