OpenAI多模态模型,支持文本、图像、音频处理。
GPT-4o 是 OpenAI 的多模态模型,o 代表 omni(全能)。和 GPT-4 比,GPT-4o 的突破是原生多模态——它能同时理解文本、图像、音频,不再需要分开调用不同模型。响应速度是 GPT-4 的 2 倍,成本降低了一半。在视觉理解、语音对话场景上表现尤为出色。通过 ChatGPT Plus 或 API 使用。
访问官网 →
DeepSeek开源大模型最新版本,高性能自然语言处理和编程能力
CogAgent官网,智谱AI和清华大学联合开发的革命性的GUI agent模型简介CogAgent,由智谱AI和清华大学联合开发,是一个革命性的GUI agent模型,它仅依赖屏幕截图作为输入,无需任何文本表征,就能预测并执行GUI操作。自发布以来,它已经在多个领域展现出卓越的性能,并获得了超
https://iuu.ai/zh iuu.ai ...
百度文心大模型 ERNIE百度AI
AI模型本地部署和RAG工具。
小米MiMo官网,提供小米自研大语言模型系列,包括MiMo-V2.5和MiMo-V2等模型,支持Token计划和API调用什么是小米MiMo?小米MiMo是小米公司自主研发的旗舰级大语言模型系列,致力于打造面向智能体时代的新一代通用智能平台。其最新发布的核心模型MiMo-V2.5-Pro是一款拥