Sensenova V6 Pro
模型AI 模型
SenseNova V6 Pro是商汤科技2025年推出的原生多模态通用大模型,采用6200亿参数混合专家(MoE)架构,支持文本、图像、视频的原生融合。其特点为多模态融合能力突出,综合性能对标行业先进水平,适用于智能客服、内容分析、教育培训等需要跨模态交互与推理的场景。
阿钰同学
浏览可用的 AI 模型入口与简介,登录后可跳转官网或项目页。
AI 模型
SenseNova V6 Pro是商汤科技2025年推出的原生多模态通用大模型,采用6200亿参数混合专家(MoE)架构,支持文本、图像、视频的原生融合。其特点为多模态融合能力突出,综合性能对标行业先进水平,适用于智能客服、内容分析、教育培训等需要跨模态交互与推理的场景。
AI 模型
SenseNova V6 Reasoner是商汤科技2025年4月发布的6000亿参数多模态MoE大模型,具备强推理、强交互、长记忆特点,可处理文本与多模态任务,适用于实时音视频交互、深度内容分析等场景。
AI 模型
商汤日日新SenseNova V6是多模态融合大模型,视频理解能力国内领先,支持10分钟中长视频解析及音视频混合模态分析,基础性能逼近Gemini 2.5 Turbo,64K思维链助力深度推理,可应用于教育、医疗、金融、内容创作等领域。
AI 模型
SenseNova V6.5 Miaohua基础版(商汤-日日新 V6.5 妙画基础版)是商汤科技 (SenseTime) 日日新 (SenseNova) 大模型体系下,专用于图像生成(文生图/图生图)的一个入门级、高性价比的模型版本。
AI 模型
SenseNova V6.5 Miaohua高级版(商汤-日日新 V6.5 妙画高级版)是商汤科技 (SenseTime) 发布的 日日新 (SenseNova) 大模型体系下,专用于**图像生成(文生图/图生图)**的一个高性能版本。
AI 模型
Spark Mini 是一款轻量级 AI 模型,属于自然语言处理领域,具备资源消耗少、训练速度快的特点,适用于日常内容创作和对话系统等场景。
AI 模型
Spark Lite Patch(星火精简补丁版)是科大讯飞 (iFLYTEK) 讯飞星火认知大模型系列中的一个特定版本或称呼
AI 模型
Spark Max是科大讯飞星火大模型的高阶版本,属于大语言模型。支持长文本处理(如Max-32K版本)、函数调用及多模态交互,适用于科研分析、企业智能客服等场景,新用户可获免费tokens。
Spark Mini 是一款轻量级 AI 模型,属于自然语言处理领域,具备资源消耗少、训练速度快的特点,适用于日常内容创作和对话系统等场景。
AI 模型
Spark Mini Instruct是轻量级大语言模型,资源消耗少、训练速度快,适用于简单文本生成、对话等日常内容创作和对话系统任务。
AI 模型
Spark Tiny(星火 Tiny)是科大讯飞 (iFLYTEK) 推出的 讯飞星火认知大模型 系列中的一个轻量级、低延迟的模型版本。
AI 模型
Spark X1是科大讯飞于2025年1月发布的深度推理大模型,基于全国产算力平台训练,核心特点包括:支持 全学段数学推理(覆盖小初高至AIME竞赛)、多路径采样验证技术优化幻觉问题,以及多语言处理能力。其应用场景已落地教育(AI学习机、教师助手)、医疗(辅助诊断系统)等领域,并于2025年7月完成迭代升级,进一步强化推理准确性与行业适配性。
AI 模型
Starcoder2_3b是ServiceNow训练的30亿参数开源代码生成模型,基于The Stack v2数据集的17种编程语言训练,处理超3万亿token。采用分组查询注意力,上下文窗口16384标记,滑动窗口注意力4096标记,支持填空目标训练。性能媲美StarCoder1-15B,适用于本地轻量编码辅助、代码补全及个人开发工具。
AI 模型
Step-1X是阶跃星辰发布的图像生成大模型,有600M、2B、8B三种参数量,分别适用于速度敏感、平衡效果速度、高效极致场景。 采用自研DiT架构,语义对齐和指令跟随能力强,深度优化中国元素,符合国人审美。
AI 模型
Step-2是阶跃星辰自研的万亿参数MoE架构语言大模型,综合能力较Step-1提升近50%,在数理逻辑、编程等多维度逼近GPT-4,指令跟随能力国际榜单居首。有轻量级mini版(快、省、性价比高)和文学大师版(强创作、去AI味),适用于智能助手、开发API及创作类应用。
AI 模型
Step-2-mini 是阶跃星辰推出的极速大模型,基于自研 MFA 注意力架构,以 3% 参数量实现 Step-2 模型 80% 性能,上下文长度 32k,代码能力突出。具备高吞吐、低时延(4000 tokens 输入首字时延 0.17 秒)及高性价比(输入 1 元/百万 token,输出 2 元/百万 token),适用于通用任务处理,API 接口已开放调用。
AI 模型
Step-Video-T2V是阶跃星辰开源的文本到视频生成模型,300亿参数,支持中英双语输入,可生成204帧540P视频。特点:高压缩比Video-VAE提升效率,Video-DPO优化质量,Turbo版生成提速3-5倍。应用于广告营销、在线教育、游戏开发、虚拟人直播等场景,降低创作门槛。
AI 模型
Step-Video-T2V-Turbo是300亿参数文本到视频模型的提速版本,通过推理步骤蒸馏技术将生成速度提升3-5倍,204帧视频耗时从743秒缩至148秒,保持90%质量。适用于短视频创作、广告营销、在线教育、游戏开发及虚拟人直播等场景,开源特性降低技术门槛。
AI 模型
Step-Video-TI2V是阶跃星辰开源的300亿参数TI2V(Text/Image-to-Video)模型,支持生成102帧5秒视频,运动可控且平衡动态与稳定性,适配华为昇腾平台,应用于影视特效、广告创意、短视频生产等领域。
阿里通义
万相2.1-I2V-14B-480P是阿里通义万相推出的图像转视频模型,140亿参数,基于DiT架构,支持480P分辨率输出,平衡画质与传输速度,适用于手机端短视频创作。操作简便,可在基石智算平台部署,上传图片加提示词即可生成动态视频,降低视频创作门槛。
阿里通义
Wan2.1-T2V-1.3B是阿里团队开发的开源文本转视频模型,基于扩散变换器技术,支持消费级GPU部署(8.19GB VRAM),4分钟内可生成5秒480P视频,适用于短视频创作、内容生成等场景。
阿里通义
Wan2.5-i2i-preview 是一款图像生成模型,支持图像编辑功能,属于阿里云图像生成服务中的一员,适用于图像创作与编辑场景。
wan2.5-i2v-preview是阿里通义万相2.5系列的图生视频模型,属多模态生成模型。它采用统一框架,融合文本、图像、视频、音频生成能力,支持1080P高清视频输出,可实现音画同步,能理解运镜语言,保持元素ID一致性,支持音频驱动视频生成,适用于广告、电商、影视、教育等领域的内容创作。
阿里通义
wan2.5-t2i-preview是阿里通义万相系列的文生图模型,属多模态生成模型。特点为支持写实场景和摄影风格,注重图像质量与响应速度平衡。适用于通用写实场景及摄影风格图像生成,可在广告、电商等领域应用。