正在加载视频...

视频加载失败

Introducing Mistral OCR 4:

163,549 次观看 • 2 个月前 •via X (Twitter)

0 条评论

暂无评论

原始帖子的评论将显示在这里

相关视频

مفهوم OCR البسيط هو أن ترفع ملف PDF أو صورة، ويقوم النظام بقراءة المحتوى وتحويله إلى نص يمكن نسخه والبحث فيه وتحليله. لكن Mistral OCR 4 يستطيع فهم بنية المستند، مثل: - العناوين والفقرات - الجداول والصور - المعادلات - ترتيب المحتوى داخل الصفحة - موقع كل عنصر - درجة الثقة في الكلمات المستخرجة كما يمكنه إعادة النتيجة بصيغة Markdown أو JSON، وهذا يجعل استخدامه أسهل داخل التطبيقات وأنظمة RAG وAI Agents. بحسب الاختبارات التي نشرتها Mistral، حقق OCR 4 نتائج متقدمة مقارنة بعدد من نماذج وخدمات OCR الأخرى، خصوصًا في المستندات المعقدة ومتعددة اللغات. لكن الاختبار الحقيقي لأي نموذج OCR يبقى على مستنداتك أنت، لأن النتيجة تختلف حسب اللغة، وجودة الصورة، والخط، والجداول، وترتيب الأعمدة. في الفيديو جربت النموذج على ملف يحتوي على كتابة يدوية ومعادلات، النتيجة: - النص المستخرج - المعادلات - نوع كل جزء داخل الصفحة - الإحداثيات Bounding Boxes - درجات الثقة - النتيجة بصيغة Markdown وJSON استخدامه يمكن أن يفيد في: - رقمنة الأرشيف - قراءة الفواتير والعقود - استخراج الجداول والبيانات - البحث داخل المستندات - بناء أنظمة RAG - تمكين الوكلاء الذكيين من فهم الملفات والتعامل معها. سأرفع المشروع المعروض في الفيديو على GitHub. كل ما تحتاجه هو إضافة مفتاح Mistral API داخل ملف البيئة، ثم تشغيل المشروع محليًا على جهازك وتجربته على مستنداتك. وتكلفة استخدام OCR 4 عبر API هي 4 دولارات لكل 1,000 صفحة، وتنخفض إلى دولارين عند استخدام Batch API. تفاصيل Mistral OCR 4 والمقارنات: GitHub:

Abdullah 🇸🇦

25,090 次观看 • 2 个月前