Vision & OCR · Modèle IA

SmolVLM2 500M Video Instruct

par HuggingFaceTB

SmolVLM2 500M Video Instruct est un modèle de vision multimodale publié par HuggingFaceTB sur Hugging Face.

Tarif100 % gratuit
AccèsOpen-weight / public
Likes Hugging Face170
Téléchargements1 519 297
Voir le modèle ↗

Ces signaux publics aident la communauté à repérer les modèles utiles.

Retour à l’annuaire

Accès gratuit

Poids publics téléchargeables gratuitement. L’exécution peut demander votre propre matériel ou un service de calcul externe. Vérifiez la licence avant utilisation.

À quoi sert SmolVLM2 500M Video Instruct ?

SmolVLM2 500M Video Instruct est un modèle de vision multimodale publié par HuggingFaceTB sur Hugging Face.

#transformers#onnx#safetensors#smolvlm#image-text-to-text#conversational#en#dataset:HuggingFaceM4/the_cauldron#dataset:HuggingFaceM4/Docmatix#dataset:lmms-lab/LLaVA-OneVision-Data#dataset:lmms-lab/M4-Instruct-Data#dataset:HuggingFaceFV/finevideo