ClovisOCR
Modèle de vision et d'OCR capable d'extraire du texte, convertir des documents en Markdown, localiser des éléments dans une image, et décrire visuellement des images. Supporte les modes DeepSearch avec grounding.
Capacités
EntréeCe que vous pouvez envoyer
ContenuPrompt + une ou plusieurs images
Formats acceptésPNGJPGWEBPURLBase64
SortieCe que le modèle produit
Formats produitsTexte brutMarkdownCoordonnées
ModesOCRDescriptionLocalisation
Grounding visuelOui
Prompt personnaliséOui