GLM 4.5 X
模型智谱 GLM
GLM-4.5-X是基于GLM-4.5架构的开源混合专家(MoE)大语言模型,总参数量3550亿,激活参数量320亿,采用89层深层结构与160专家设计。支持思维/直接响应双模式切换,擅长智能体任务、复杂推理及代码生成,在TAU-Bench(70.1%)、AIME 24(91.0%)等基准测试中表现优异,适用于科研、工程开发及智能系统构建。
阿钰同学
浏览可用的 AI 模型入口与简介,登录后可跳转官网或项目页。
智谱 GLM
GLM-4.5-X是基于GLM-4.5架构的开源混合专家(MoE)大语言模型,总参数量3550亿,激活参数量320亿,采用89层深层结构与160专家设计。支持思维/直接响应双模式切换,擅长智能体任务、复杂推理及代码生成,在TAU-Bench(70.1%)、AIME 24(91.0%)等基准测试中表现优异,适用于科研、工程开发及智能系统构建。
智谱 GLM
GLM-Z1-Air是智谱AI推出的32B参数开源大模型,主打高速推理与深度思考能力。其推理速度达200+Tokens/s,较主流模型提升8倍,成本仅为1/30,支持消费级硬件部署。具备强大数理逻辑推理与多步决策能力,适用于复杂问题求解、代码生成、AI智能体开发等场景,可通过Z.ai平台免费体验。
智谱 GLM
GLM-Z1-AirX是智谱AI推出的32B参数推理模型,定位“瞬时”极速版,推理速度达200 Tokens/s,比常规模型快8倍,具备更高性价比(速度优先)。适用于代码生成、数学推理、智能客服等实时交互场景。
智谱 GLM
GLM-Z1-Flash是智谱AI发布的轻量级快速推理模型,为GLM-Z1系列成员,基于GLM-4-Flash基座优化,遵循MIT开源协议且完全免费调用。其通过算法优化实现高效资源调度,保持与更大规模模型相近的推理性能(如代码生成、数学推理),特点为更轻量、高速,适用于轻量级实时交互场景。
OpenAI
GPT-3.5 Turbo是OpenAI推出的高效能自然语言处理模型,基于GPT架构优化,参数规模精简但性能强劲,支持自然语言理解与生成及代码任务,上下文窗口16,385 tokens,训练数据截至2021年9月。其特点为响应快、成本效益高,是GPT-3.5系列中功能最强且经济的模型,适用于聊天交互、客服、教育辅助、代码生成等场景,也是ChatGPT的基础模型。
OpenAI
GPT-4.1是OpenAI推出的多规格大语言模型,包括GPT-4.1、Mini和Nano版本,主打编码优化,较GPT-4o提升60%,支持百万token长上下文,指令遵循更精准,退化行为减少,适用于复杂编程、结构化文档分析与多跳推理,供开发者通过API调用。
OpenAI
GPT-4.1 mini是OpenAI推出的中小型多模态模型,支持百万token上下文,可处理文本、图像及视频。性能媲美GPT-4o,MMMU测试得分73%超前代,延迟降半、成本减83%,适用于开发者API调用,处理长内容与视觉任务。
OpenAI
GPT-4.1 nano是OpenAI推出的超小型语言模型,定位为速度最快、成本最低的""小核""产品,支持百万token上下文,适用于自动补全、分类、信息提取等低延迟边缘场景,MMLU得分80.1%,部分性能超GPT-4o mini,API调用成本极低。
OpenAI
GPT-4.5是OpenAI于2025年推出的大型语言模型,属GPT系列升级版。它通过扩大无监督学习规模,提升模式识别与关联能力,减少推理依赖,实现更自然交互。具备更广泛知识库、更强用户意图理解与“情商”,适用于写作优化、编程辅助及解决实际问题,且幻觉现象显著减少。
OpenAI
GPT-4o是OpenAI开发的多模态大语言模型,于2024年5 月发布,“o”代表“全能”,支持文本、图像等多模态处理。性能高效,应用于对话、内容生成、图像理解等场景,2025年3月更新后图像生成能力媲美专业工具,优化指令解析与创造力。
OpenAI
GPT-4o mini是OpenAI推出的轻量化多模态大语言模型,支持文本/图像输入,较GPT-3.5-turbo更智能且速度相当,响应迅速,适用于基础文本生成、简单信息查询等日常任务,免费用户可自动切换使用,简化了数据分析等高级功能。
OpenAI
GPT-5是OpenAI推出的新一代旗舰大语言模型,采用统一架构与智能路由机制,可自动切换快速响应或深度推理模式。其核心特点包括行业领先的编码能力(SWE-bench Verified得分74.9%)、多模态处理、低幻觉率及优化的指令遵循能力,适用于编程开发、内容创作、医疗咨询、复杂问题推理等场景,提供Plus/Pro等分级服务。
OpenAI
GPT-5 Codex是OpenAI推出的多模型混合代码生成系统,整合高效基础模型与深度推理模块,通过智能路由动态调度资源。其代码生成能力显著提升,可快速构建复杂前端应用、调试大型代码库,支持单提示生成完整网站和游戏,在设计美学处理上更优。适用于编程开发、应用构建及代码调试场景,免费用户可基础使用,付费版提供更高限额与扩展推理能力。
OpenAI
GPT-5 Mini是OpenAI推出的轻量级语言模型,主打高效低成本,适用于结构化任务如表单填写、数据提取及标准化内容生成。其降低计算资源需求,让中小企业可负担高质量AI服务,平衡性能与成本,是预算有限团队的可靠选择。
OpenAI
GPT-5 nano是OpenAI推出的超低延迟版大模型,属轻量级API专用版本,主打速度与成本优化。输入token定价为GPT-4o的二分之一,支持token缓存与细粒度推理控制,适合高频低推理任务及对响应速度要求极高的开发场景,如实时交互、批量查询等。
OpenAI
GPT OSS 120B 是 OpenAI 2025 年开源的千亿参数大语言模型,采用混合专家架构,单卡 H100 GPU 即可部署。具备强推理、Agent 能力,支持推理成本调节与思维链追溯,Apache 2.0 许可,适用于生产级任务与智能代理开发。
Gemini 1.5 Flash 是谷歌 Gemini 家族轻量级多模态语言模型,通过知识蒸馏自 Pro 版,保留 transformer 解码器架构与多模态能力,支持超长上下文处理,高效利用 TPUs 实现低延迟,适用于高负载任务,如文档分析、代码调试等,兼顾速度与成本。
Gemini 1.5 Flash 8B是谷歌推出的轻量级多模态语言模型,参数规模80亿,支持文本、图像、音频等多模态处理。特点为低成本(100万输入令牌0.0375美元)、高效率,适用于大容量低复杂度任务。使用场景包括初创企业AI开发测试、基础多模态应用等。
Gemini 1.5 Pro是谷歌DeepMind开发的多模态大模型,采用稀疏混合专家架构,支持文本、图像、音频、视频及代码理解,上下文窗口达128万token,推理效率较前代提升40%。适用于电商客服、推荐系统等通用场景,可与Google Maps等生态集成,性价比均衡但中文术语处理需优化。
Gemini 2.0 Flash是谷歌推出的多模态AI模型,属Gemini 2.0套件子模型。具备文本理解、图像生成与编辑能力,支持100万token上下文窗口,响应速度比1.5 Pro快两倍。适用于广告设计、社交媒体内容创作、教育插图生成等场景,开发者可通过Google AI Studio和Gemini API接入。
Gemini 2.0 Flash Lite 是 Gemini 2.0 系列中速度最快的模型,经过优化以实现更高的成本效益和更低的延迟。它旨在处理高吞吐量的轻量级任务,并支持多模态输入(如图片、文档和音频),具有巨大的输入 token 上限
Gemini 2.0 Flash Thinking是谷歌推出的多模态推理大模型,主打快速响应与复杂任务处理,支持文本、图片等多模态输入输出,具备工具调用和空间理解能力,适用于编程、数学及图像分析等场 景,部分功能仍处实验阶段。
Gemini 2.5 Flash是谷歌推出的多模态轻量级AI模型,支持文本、图像、音频、视频输入,具备自适应推理能力,令牌使用效率提升20-30%,适用于高吞吐量、低延迟任务,如翻译、分类及多模态交互,面向开发者与企业用户开放。
Gemini 2.5 Flash-Lite是谷歌推出的轻量级AI推理模型(预览版),主打极速响应与成本优化,为当前速度最快的Gemini模型。支持多模态输入、100万token上下文及谷歌原生工具(如搜索、代码执行),适用于高吞吐量、低延迟场景(如翻译、分类),面向开发者提供API服务。