Doubao Seedream 3.0 T2i
模型字节豆包
Doubao - Seedream - 3.0 - t2i是字节跳动推出的中英双语图像生成基础模型,属文生图第一梯队。特点:2k原生高分辨率,小字生成准、排版优,指令遵循力强,美感与结构佳,响应速度快,EvalMuse等多测试排名第一。适用于设计、创意等场景。
阿钰同学
Browse AI model entries and short intros; sign in to open official or project pages.
字节豆包
Doubao - Seedream - 3.0 - t2i是字节跳动推出的中英双语图像生成基础模型,属文生图第一梯队。特点:2k原生高分辨率,小字生成准、排版优,指令遵循力强,美感与结构佳,响应速度快,EvalMuse等多测试排名第一。适用于设计、创意等场景。
字节豆包
Doubao - Seedream - 4.0是国产多模态生图模型,支持文本与图像组合输入,能深度理解提示词,避免元素分离与拼凑问题,可生成4K高清图像。适用于设计师、插画师、广告及影视分镜创作等场景。
百度
ERNIE-4.5-0.3B是百度推出的0.36B参数轻量级语言大模型,基于PaddlePaddle框架,支持SFT、DPO等基础微调,采用卷积编码量化技术实现4位/2位无损压缩,适配多芯片边缘部署,适用于对话、创作及轻量化文本处理场景,开源协议为Apache 2.0。
百度
ERNIE-4.5-21B-A3B-Paddle是百度推出的文本混合专家(MoE)语言大模型,总参数量210亿,每个token激活30亿参数。采用异构MoE架构与模态隔离路由技术,依托飞桨框架优化,适配智能对话、内容创作等轻量化场景,提供ERNIEKit微调与FastDeploy部署工具链,基于Apache 2.0协议开源。
百度
ERNIE-4.5-21B-A3B-Thinking是百度开源的深度思考模型,采用混合专家(MoE)架构,总参数210亿,每token激活30亿参数。支持128K上下文窗口,适用于长文本推理、逻辑数学科学任务、代码生成及工具调用,实现高效复杂任务自动化处理。
百度
ERNIE-4.5-300B-A47B-Paddle是百度文心大模型4.5系列中的300B参数多模态模型,采用异构MoE架构,单次推理激活470亿参数,支持128K超长上下文,通过2-bit压缩技术实现低资源部署。适用于医疗影像分析、长文档解析、工业质检 等复杂场景,兼顾高性能与部署效率。
百度
ERNIE 4.5 Turbo是百度文心推出的多模态大模型,采用异构MoE架构,支持文本、图像等跨模态交互。具备4240亿参数规模,通过低比特量化优化实现高效推理,部署成本降低70%,适配边缘设备及企业级场景,兼顾高性能与轻量化需求。
百度
ERNIE 4.5 Turbo VL是百度推出的多模态视觉语言模型,具备高效图文理解与推理能力。其采用MoE架构,支持动态激活参数(如47B/424B),兼顾性能与效率,可部署于普通设备。适用于OCR、文档解析、跨模态问答等场景,能处理高 分辨率视觉输入并支持多语言交互。
百度
ERNIE-4.5-VL-28B-A3B是百度开源的280亿参数多模态模型,具备文本与图像/视频理解能力。特点包括工程图纸理解准确率98.2%、降低40%误检率,支持从图表到报告全流程生成。应用于新闻出版(效率提升3倍)、制造业质检、法律文书分析等场景,已适配英特尔等硬件加速卡。
百度
ERNIE-4.5-VL-424B-A47B-Paddle是百度文心4.5系列多模态大模型,采用异构MoE架构,支持""思考/非思考""双模式,在MathVista等多模态基准测试中表现比肩OpenAI-o1,已部署于工业质检等边缘设备场景。
百度
ERNIE X1 Turbo是百度推出的深度思考推理模型,具备先进“思维链”流程,提升复杂 逻辑推理能力,支持多模态处理与工具利用。适用于文学创作、代码生成等场景,成本较竞品更低。
百度
ERNIE X1.1 Preview是百度文心基于文心4.5开发的深度思考模型,采用迭代式混合强化学习框架,在智能体、工具调用、指令遵循及事实性上显著提升。支持通用任务与人机协作,官方评测显示其效果与GPT-5、Gemini 2.5 Pro持平,领先DeepSeekR1-0528,可通过文心一言官网等平台使用。
智谱 GLM
GLM-4是智谱AI研发的第四代通用预训练大语言模型,基于Transformer架构,2024年推出基础版,2025年迭代至GLM-4.6版本。其核心特点包括:在中英文基准测试(如MMLU、GSM8K)中性能接近GPT-4,中文指令理解和对齐度超越GPT-4;支持200K上下文窗口,长文本处理能力媲美GPT-4 Turbo;智能工具调用能力(Web搜索、代码解释器等)超越GPT-4 All Tools;推理效率提升,Token消耗减少30%,并适配国产芯片降低部署成本。应用场景涵盖代码开发、智能体构建、长文本分析及国产化AI解决方案,已开源并通过MaaS平台提供API服务。
智谱 GLM
GLM-4-9B是由智谱AI推出的开源大语言模型,属GLM-4系列。具备多模态能力,支持26种语言,上下文处理达1M token(约200万字),中文对齐和代码能力提升40%,可调用外部工具,适用于长文本处理、多语言交互和复杂任务协作。
智谱 GLM
GLM-4-AllTools是智谱AI推出的智能体优化型大语言模型,基于GLM-4架构强化工具调用能力。特点包括自主规划工具使用(支持联网搜索、代码解释器、文生图等)、多模态任务处理及超长上下文理解。适用于复杂推理、数据分析、智能开发等场景,部分任务表现优于GPT-4 All Tools。
智谱 GLM
GLM-4-Assistant是智谱AI开发的多模态对话大模型,支持128K上下文(部分版本达1M token),中文对齐能力超GPT-4,可动态调用多工具协同处理复杂任务。适用于学术解析、长文档处理、智能客服等场景。
智谱 GLM
GLM-4-Flash是智谱AI推出的高效能大语言模型,基于10T多语言数据训练,采用FP8技术提升效率。特点包括128K长上下文推理、72.14 token/s生成速度,支持多轮对话与工具调用。适用于智能助手、内容生成、RAG知识库等场景,提供免费API。
智谱 GLM
GLM-4-FlashX是智谱AI开发的GLM-4系列语言模型,定位为高性能推理模型,具备超快推理速度与高并发处理能力,主 打极致性价比以降低使用门槛。适用于智能对话、文本处理等场景,通过API接口提供服务,需通过智谱MaaS平台调用。
智谱 GLM
GLM-4-Long是智谱AI推出的长文本大模型,支持1M tokens(约150-200万字)上下文,100万tokens仅需1元。适用于小说创作、学术综述、代码文档生成等场景,提供“构思-初稿-润色”全流程支持。
智谱 GLM
GLM-4-Plus 是智谱AI于2024年推出的大语言模型,属GLM-4系列增强版。采用合成数据优化与PPO算法提升推理能力,在SuperCLUE测评中位列国内第一梯队,与GPT-4o差距小于2分。支持API调用,适用于文本生成、智能问答等场景,需通过智谱开放平台接口使用。
智谱 GLM
GLM-4.5是开源混合专家(MoE )大语言模型,总参3550亿(激活320亿),支持思维与直接响应混合推理。23万亿Token训练后,在智能体、推理和编码任务表现优异,如TAU-Bench得分70.1%、AIME 24达91.0%、SWE-bench Verified 64.2%。有3550亿参数版及轻量1060亿参数版,适用于复杂推理、工具调用及快速响应场景。
智谱 GLM
GLM-4.5-Air是清华智谱推出的轻量级千亿参数大语言模型,采用MoE架构(1060亿总参数/120亿激活参数),主打混合推理能力,支持复杂任务的思考模式与快速响应的非思考模式切换。其量化版本(如4-bit AWQ)模型文件仅64GB,适配本地部署与边缘设备,平衡性能与效率。适用于智能代理开发、工具调用及资源受限场景,已开源并开放API接口。
智谱 GLM
GLM-4.5-AirX是智谱AI推出的轻量级混合推理大模型,总参数1060亿(激活参数120亿),采用MoE架构,原生融合推理、编码和智能体能力,支持思考(复杂推理/工具使用)与非思考(即时响应)双模式,适用于智能体开发、本地部署及多语言处理,MIT协议开源可商用。
智谱 GLM
GLM-4.5-Flash是智谱AI发布的开源基础模型,采用混合专家(MoE)架构,提供思考/非思考双推理模式,支持工具调用与多框架兼容。适用于智能体开发、代码生成及复杂推理,MIT协议允许商用,性价比高。