أعلنت شركة Cohere عن إطلاق نموذج Parse v5.0، وهو نموذج رؤية لغوي متخصص في معالجة كميات كبيرة من الوثائق داخل المؤسسات. يتضمن النموذج 2.3 مليار معامل مع نافذة سياق تبلغ 8192 رمز، وحجم تخزين يقترب من 4.6 غيغابايت.
يقبل النموذج ملفات PDF وPowerPoint والصور بصيغة JPEG ويحولها إلى نصوص منسقة بصيغة Markdown تتضمن النصوص بترتيب القراءة الطبيعي، والجداول بصيغة HTML، والقوائم، وأزواج المفاتيح والقيم في النماذج، مع وصف الصور وإحداثيات الحدود. يعمل النموذج دون الحاجة إلى مرحلة معالجة نصية منفصلة، بل يستخرج كل ما سبق في مرة واحدة.
يدعم النموذج تسع لغات بمستوى ثابت من الدقة: العربية والإنجليزية والفرنسية والألمانية والإيطالية واليابانية والكورية والبرتغالية والإسبانية، مع إمكانية دعم لغات أخرى بدقة أقل. يوفر النموذج أسلوبي إخراج: الأول يعيد سلسلة Markdown لكل صفحة، والثاني يعيد كتل محددة النوع توفر تتبعًا دقيقًا للمصدر.
تسعّر Cohere الخدمة بمعدل 1.50 دولار لكل ألف صفحة عبر واجهة برمجية عامة، مع توفرها أيضًا عبر منصات Microsoft Foundry وAWS SageMaker وModel Vault. حققت الشركة درجة 79.2 على معيار ParseBench، متقدمة على منافسين مثل Mistral OCR 4 و Azure Document Intelligence و Databricks AI Parse.
يستند حساب النقطة إلى متوسط ثلاثة من خمسة أبعاد في معيار ParseBench: الجداول والدقة المضمونية والتنسيق الدلالي. يشير التحليل إلى أن المؤسسات التي تعالج ما يزيد على مليون و670 ألف صفحة شهريًا قد تجد الاشتراك المخصص أرخص من النموذج المقاس.
Comments (0)
No comments yet. Be the first.