← 返回列表

Grok 3 Vision

多模态 vision
上下文窗口 128,000
最大输出 8,192
输入类型 文字/图片
输出类型 文字

模型描述

xAI首款原生多模态Grok,支持图像理解与生成描述。

特性标签

# 多模态 # 实时 # 视觉推理