资源库
视觉 AI Models
侧重图像理解、视觉问答与视觉分析的模型。
Doubao-1.5-vision-pro
ByteDance
豆包视觉模型,支持图像理解与多模态任务。
visionmultimodal
视觉专有
GLM-4.5V
Zhipu AI
智谱 GLM-4.5V 视觉语言模型,支持图像理解。
visionmultimodal
视觉专有
Llama 3.2 90B Vision Instruct
Meta
Llama 3.2 视觉指令模型,支持图像理解与视觉问答。
open-weightvisionmultimodal
视觉开放权重
Pixtral Large
Mistral AI
Mistral 多模态视觉语言模型,支持图像理解。
visionmultimodal
视觉专有
Qwen2.5-VL
Alibaba
通义千问视觉语言模型,支持图像理解与多模态对话。
visionmultimodalopen-weight
视觉开放权重