Gemini 2.5 Pro
模型Gemini 2.5 Pro是谷歌推出的多模态大型基础模型,具备强化推理能力,支持文本、代码、音视频等处理,拥有百万令牌上下文窗口。在代码生成、数学及STEM任务表现卓越,适用于复杂问题推理、大数据分析及企业级开发。
阿钰同学
浏览可用的 AI 模型入口与简介,登录后可跳转官网或项目页。
Gemini 2.5 Pro是谷歌推出的多模态大型基础模型,具备强化推理能力,支持文本、代码、音视频等处理,拥有百万令牌上下文窗口。在代码生成、数学及STEM任务表现卓越,适用于复杂问题推理、大数据分析及企业级开发。
Gemini 2.5 Pro Preview 06-05是谷歌Gemini 2.5系列的全能力旗舰大模型,支持文本、图像、音视频等多模态输入,具备百万级上下文处理能力(输入超100万tokens,输出64K tokens),采用动态推理预算机制优化复杂任务准确率。适用于学术研究、软件开发、创意工作及企业数据分析等场景。
Gemini Diffusion是Google DeepMind推出的实验性文本扩散语言模型,采用扩散技术通过逐步优化噪声生成输出,非传统自回归逐词预测。其特点为生成速度快(2000token/秒),支持迭代纠错与编辑,编程和数学任务表现出色。适用于快速文本生成、代码编写及数学问题解决等场景。
Gemma 2 27B是谷歌开源的轻量级文本生成大模型,基于Transformer架构,性能媲美LLaMA3 70B。支持单GPU/TPU高效推理,适配家用电脑及云端部署,适用于低成本AI开发与本地部署场景。
Gemma 2 9B是谷歌DeepMind开发的开源轻量级大语言模型,属Gemini技术体系,90亿参数规模。特点:采用滑动窗口注意力与知识蒸馏技术,8万亿token训练,性能超Llama 3 8B;支持多框架部署,适配边缘设备与云端。适用于边缘AI、文档问答、代码生成等场景。
Gemma 3 12B是谷歌推出的开源多模态大语言模型,120亿参数,基于Transformer架构,支持文本、图像输入及140+语言,上下文窗口128K,适用于摘要、问答等任务,可在单GPU部署,平衡性能与硬件需求。
Gemma 3 1B是谷歌DeepMind开源的轻量级纯文本模型,参数规模10亿,基于2T token数据训练。特点为轻量高效,支持单块GPU/TPU运行,上下文窗口32k token,适配手机、笔记本等资源受限设备,适合快速部署和低功耗场景。
Gemma 3 27B是谷歌2025年推出的开源轻量级多模态大模型,基于Gemini 2.0技术构建,270亿参数规模。支持文本和图像处理,128K上下文窗口,140余种语言,单GPU即可运行。LMArena测试超Llama-405B等模型,适用于端侧部署、多模态分析、跨语言任务。
Gemma 3 4B是谷歌DeepMind推出的轻量级多模态开源模型,支持文本与图像输入,采用SigLIP视觉编码器,400M参数,896×896分辨率处理。具备128K上下文窗口、140+语言理解能力,优化长文本推理,单GPU可运行,适用于本地部署的智能问答、图像分析和多语言任务。
Gemma 3n E2B是谷歌推出的多模态边缘AI模型,支持文本、图像、音频、视频本地处理,性能媲美5B参数模型,低内存功耗设计适配智能手机、可穿戴设备,实现隐私保护与实时交互。
Gemma 3n E2B Instructed是谷歌DeepMind开发的轻量级多模态模型,基于MatFormer架构,仅需2GB内存即可运行。支持文本、图像、音频、视频处理,适用于手机、树莓派等边缘设备本地部署,可用于聊天机器人、内容生成、多模态数据提取等场景。
Gemma 3n E2B Instructed LiteRT (Preview)是谷歌Gemma 3系列轻量级开放模型,基于MatFormer架构与PLE技术优化,有效参数2B(原始5B),2GB内存即可运行。支持文本/图像/音频多模态,140种语言,适用于手机、笔记本等设备端实时任务,如问答、内容分析。
Gemma 3n E4B是 谷歌推出的轻量级多模态模型,属Gemma 3n系列,性能媲美8B参数模型,支持文本、图像、音频、视频处理,可在手机等边缘设备本地运行,低内存功耗。适用于无障碍技术、移动创作、教育研究及物联网设备。
Gemma 3n E4B Instructed是谷歌Gemma 3系列轻量级多模态开放模型,有效参数4B(原始8B),指令调优版本。特点:原生支持文本/图像/音频/视频输入,仅需3GB内存运行,响应速度快,LMArena得分超1300,支持140种语言,适用于设备端实时处理、多模态问答、本地部署等场景。
Gemma 3n E4B Instructed LiteRT Preview是谷歌2025年推出的轻量级开源多模态模型,属Gemma 3n系列E4B版本(有效参数4B)。支持文本、图像、音频输入,文本输出,32K上下文,英法/英西翻译准确率超92%。优化内存 占用(约3GB),适配移动设备与边缘计算,响应速度快,适用于本地部署的实时交互场景。
OpenAI
gpt-oss-20b是OpenAI 2025年推出的开源推理大模型,210亿总参数,激活36亿参数,采用MoE架构与MXFP4量化技术,性能比肩o3-mini,16GB内存即可本地部署,适用于开发者工作站、边缘设备及低延迟场景,Apache 2.0许可证支持商用与修改。
xAI
Grok-1.5是xAI于2024年3月发布的语言模型,基于优化训练系统提升推理能力,支持128K令牌上下文,在数学(MATH 50.6%、GSM8K 90%)和代码生成(HumanEval 74.1%)任务表现突出,面向X平台早期测试者提供长文本理解与高级推理功能。
xAI
Grok-1.5V是xAI推出的多模态AI模型,支持文本、图像等处理,具备128K长上下文与高级推理能力,数学、编码任务表现优异。适用于专业问题解决、日常交互,未来或集成于特斯拉车辆。
xAI
Grok-2是xAI开发的多模态大模型,支持文本、图像、视频交互,具备实时信息获取(DeepSearch模式)、代码生成与代理任务能力,强调逻辑推理与客观性。适用于科学查询、创意生成、编程开发及特斯拉车载交互等场景,支持网页和移动应用访问。
xAI
Grok-2 mini 是 xAI 推出的轻量化 AI 模型,基于 Grok-2 优化,特点为快速响应、文本交互友好,适用于简单文本任务。支持多语言处理,可集成实时检索能力,应用于问答、信息检索及基础文本生成。
xAI
Grok-3是Elon Musk旗下xAI公司推出的旗舰大模型,以强大推理能力为核心,采用""思想链""功能,在数学、科学等领域表现突出,超过GPT-4o等模型。 其追求事实呈现,避免过度""政治正确"",适用于复杂问题分析与专业领域辅助。
xAI
Grok-3 Mini是xAI推出的轻量级AI模型,属Grok-3系列,主打高效推理。特点:131K tokens上下文窗口,支持高推理模式(AIME竞赛得分超90),低推理模式平衡响应速度与准确性。适用于日常对话、邮件撰写、基础编程及中小学数学解题等场景。
xAI
Grok-4是xAI开发的大语言模型,采用模块化架构与多智能体协同设计,支持25.6万Token上下文,具备高效推理与多模态能力。适用于长文档分析、复杂任务处理及特斯拉车载交互等场景。
xAI
Grok 4 Fast是xAI于2025年推出的大语言模型轻量版本,主打高速推理与成本优化。其核心特点包括:每秒75 token生成速度(较标准版快10倍),200万token超长上下文窗口,支持整本书籍或代码库一次性处理;推理成本降低98%,通过优化架构减少40%推理tokens消耗。作为Grok 4系列基础版本,它集成文本/图像输入、实时网络访问(DeepSearch工具)及函数调用能力,面向日常问答、文档处理等轻量化场景,计划逐步替代Grok 3成为免费用户基础服务。该模型在保持多模态能力的同时,以效率优先设计适配普通用户需求。