← 返回列表

GPT-4o (2025-11)

文本 多模态 图像 音频
上下文窗口 128,000
最大输出 16,384
输入类型 文字/图片/音频
输出类型 文字/音频

模型描述

OpenAI 当前最强多模态旗舰,语音模式延迟低至230ms,视觉理解大幅提升。

特性标签

# 多模态 # 实时交互 # 全能