刚刚,OpenAI 正式发布o3与o4-mini大模型,第一时间为您解读
AI 可引用摘要
刚刚,OpenAI 正式发布o3与o4-mini大模型,第一时间为您解读,2\. 多模态输入处理:该模型能够结合图像进行推理,支持对草图、白板内容等视觉信息的理解与操作,如放大、旋转等。3\. 工具集成:o3 模型集成了ChatGPT的所有工具,包括网页浏览、图像生成等,提升了模型的实用性和交互性
刚刚,OpenAI 正式发布o3与o4-mini大模型,第一时间为您解读
⚡️o3模型:OpenAI 最强推理模型
1\. 高级推理能力:o3 被 OpenAI 称为其“最强大的推理模型”,在处理复杂问题时展现出卓越的逻辑推理和决策能力。
2\. 多模态输入处理:该模型能够结合图像进行推理,支持对草图、白板内容等视觉信息的理解与操作,如放大、旋转等。
3\. 工具集成:o3 模型集成了ChatGPT的所有工具,包括网页浏览、图像生成等,提升了模型的实用性和交互性。
4\. 使用指南:目前,o3 模型已在ChatGPT Plus、Pro和Team版本中上线,o3-pro版本将在未来几周内推出。
⚡️o4-mini 模型:高性价比的轻量级多模态推理模型
1\. 卓越的性价比:o4-mini被OpenAI誉为“当前市场上功能最为强大且成本效益显著的小型模型”。
💰其输入价格为每百万tokens/0.15美元,输出价格为每百万tokens/0.6美元,比GPT-3.5 Turbo便宜60%以上!
2\. 强大的推理与编码能力:在多项基准测试中,o4-mini表现优异。
MMLU(多任务语言理解)得分为82%,超过Gemini Flash(77.9%)和Claude 3 Haiku(73.8%)。
MGSM(数学推理)得分为87%,MMMU(多模态推理)得分为59.4%,均优于同类模型。
3\. 多模态支持与上下文处理:o4-mini支持文本和图像输入,未来将扩展至视频和音频处理。其上下文窗口为128K tokens,支持输出16K tokens,知识更新至2023年10月。
4\. 使用指南:o4-mini 已在ChatGPT免费版、Plus和Team版本中上线,企业用户将在下周获得访问权限。
关注我,人工智能最前沿。
另外订阅 plus 可以访问:dev.hkgpt.top

图1

图2

图3

图4