داشبورد توسعه‌دهنده
پرسش از هوش مصنوعی
پرسش از هوش مصنوعی

مدل جدید اضافه شد: Mistral OCR Latest

تاریخ: 1404-02-25 / (2025-05-15)

خلاصه

ما با افتخار اضافه شدن مدل mistral-ocr-latest به AvalAI را اعلام می‌کنیم. این مدل قدرتمند OCR به شما امکان استخراج متن و محتوای ساختاریافته از اسناد PDF و تصاویر را می‌دهد، در حالی که قالب‌بندی، ساختار و سلسله مراتب را حفظ می‌کند. این مدل نتایج را در قالب مارک‌داون برای تجزیه و تحلیل و رندر آسان ارائه می‌دهد. Mistral OCR استانداردی جدید در درک اسناد با عملکرد پیشرفته، قابلیت‌های چندزبانه و سرعت پردازش استثنایی ایجاد می‌کند.


جزئیات

Mistral AI

  • mistral-ocr-latest: یک مدل قدرتمند OCR که متن و محتوای ساختاریافته را از اسناد استخراج می‌کند در حالی که قالب‌بندی و ساختار را حفظ می‌کند، با دقت برتر در انواع مختلف اسناد از جمله طرح‌بندی‌های پیچیده، عبارات ریاضی، جداول و محتوای چندزبانه. مستندات

ویژگی‌های کلیدی

  • استخراج محتوای متنی با حفظ ساختار و سلسله مراتب سند
  • حفظ قالب‌بندی مانند سرفصل‌ها، پاراگراف‌ها، لیست‌ها و جداول
  • ارائه نتایج در قالب مارک‌داون برای تجزیه و تحلیل و رندر آسان
  • پشتیبانی از طرح‌بندی‌های پیچیده شامل متن چند ستونی و محتوای ترکیبی
  • پردازش اسناد در مقیاس بالا با دقت زیاد (تا 2000 صفحه در دقیقه روی یک نود)
  • پشتیبانی از فرمت‌های مختلف سند از جمله PDF، تصاویر و اسناد آپلود شده
  • به صورت ذاتی چندزبانه، قادر به تجزیه و تحلیل هزاران نوع خط، فونت و زبان
  • عملکرد برتر نسبت به سایر مدل‌های پیشرو OCR در آزمون‌های معیار
  • قیمت‌گذاری 1000 صفحه به ازای هر دلار (تقریبا دو برابر با استنباط دسته‌ای)
  • در دسترس برای میزبانی شخصی برای سازمان‌هایی با نیازهای داده حساس

مثال‌های استفاده

مدل Mistral OCR را می‌توان با API AvalAI استفاده کرد. توجه داشته باشید که برخلاف سایر مدل‌های سازگار با OpenAI، مدل‌های Mistral AI از ساختار نقطه پایانی متفاوتی بدون بخش مسیر "/v1" استفاده می‌کنند.

python
from mistralai import Mistral

client = Mistral(server_url="https://api.avalai.ir", api_key="avalai-api-key")

document_param = {
    "type": "document_url",
    "document_url": "https://arxiv.org/pdf/1805.04770",
}

ocr_response = client.ocr.process(
    model="mistral-ocr-latest",
    document=document_param,
    pages=list(range(0, 100)),  # پردازش تا 100 صفحه
    retries=3,
)

print(ocr_response)
javascript
import { Mistral } from "mistralai";

const client = new Mistral({
  apiKey: "avalai-api-key",
  baseURL: "https://api.avalai.ir",
});

const documentParam = {
  type: "document_url",
  document_url: "https://arxiv.org/pdf/1805.04770",
};

const ocrResponse = await client.ocr.process({
  model: "mistral-ocr-latest",
  document: documentParam,
  pages: Array.from({ length: 100 }, (_, i) => i),
  retries: 1,
});

console.log(ocrResponse);

درک سند

مدل mistral-ocr-latest همچنین می‌تواند با مدل‌های زبانی ترکیب شود تا امکان تعامل زبان طبیعی با محتوای سند را فراهم کند. این به شما امکان می‌دهد با پرسیدن سؤالات به زبان طبیعی، اطلاعات و بینش‌ها را از اسناد استخراج کنید.

قابلیت‌های کلیدی:

  • پاسخگویی به سؤالات در مورد محتوای خاص سند
  • استخراج اطلاعات و خلاصه‌سازی
  • تجزیه و تحلیل سند و ارائه بینش‌ها
  • پرس و جوهای چند سندی و مقایسه‌ها
  • پاسخ‌های آگاه از زمینه که کل سند را در نظر می‌گیرند
  • گزینه‌های خروجی ساختاریافته (مانند JSON) برای پردازش پایین‌دستی

موارد استفاده کلیدی

Mistral OCR امکان طیف گسترده‌ای از کاربردهای پردازش اسناد را فراهم می‌کند:

  • تحقیقات علمی: تبدیل مقالات علمی با فرمول‌ها و نمودارهای پیچیده به فرمت‌های آماده هوش مصنوعی
  • حفظ میراث تاریخی: دیجیتال‌سازی اسناد و آثار تاریخی برای دسترسی گسترده‌تر
  • خدمات مشتری: تبدیل مستندات و راهنماها به پایگاه‌های دانش نمایه‌شده
  • آموزش: تبدیل یادداشت‌های سخنرانی و ارائه‌ها به محتوای قابل جستجو
  • حقوقی: پردازش پرونده‌های نظارتی و اسناد حقوقی
  • مهندسی: استخراج اطلاعات از متون فنی و نقشه‌ها

انواع فایل‌های پشتیبانی شده

  • اسناد PDF (تا 50 مگابایت و 1000 صفحه)
  • تصاویر در فرمت‌های PNG، JPEG، WEBP و GIF غیر متحرک

لینک‌های مرتبط