← 返回列表
Grok 3 Vision
多模态
vision
上下文窗口
128,000
最大输出
8,192
输入类型
文字/图片
输出类型
文字
模型描述
xAI首款原生多模态Grok,支持图像理解与生成描述。
特性标签
# 多模态
# 实时
# 视觉推理