← 返回列表
GPT-4o (2025-11)
文本
多模态
图像
音频
上下文窗口
128,000
最大输出
16,384
输入类型
文字/图片/音频
输出类型
文字/音频
模型描述
OpenAI 当前最强多模态旗舰,语音模式延迟低至230ms,视觉理解大幅提升。
特性标签
# 多模态
# 实时交互
# 全能