Deepseek R1
模型AI 模型
DeepSeek-R1是深度求索团队开发的专注推理能力的大语言模型,通过强化学习直接优化推理,在数学、编程和科学推理等复杂任务表现出色,适用于深度逻辑分析场景,采用MIT许可协议开源。
阿钰同学
Browse AI model entries and short intros; sign in to open official or project pages.
AI 模型
DeepSeek-R1是深度求索团队开发的专注推理能力的大语言模型,通过强化学习直接优化推理,在数学、编程和科学推理等复杂任务表现出色,适用于深度逻辑分析场景,采用MIT许可协议开源。
AI 模型
DeepSeek-R1-Distill-Llama-8B是基于Llama-3.1-8B基座模型的开源蒸馏模型,通过DeepSeek-R1推理数据微调,保留原版90.2%数学推理能力(MATH-500达89.1%),代码生成能力达72.3%,推理速度提升5.8倍,单GPU(24GB)即可部署,适用于本地部署、RAG系统构建及教育、编程辅助等场景。
AI 模型
DeepSeek-R1-Disti ll-Qwen-1.5B是基于Qwen架构的1.5B参数小型语言模型,通过知识蒸馏技术从DeepSeek-R1迁移推理能力。特点:轻量化设计,推理速度快,资源消耗低,在数学推理等任务表现优于同量级模型。适用于小型企业智能客服、个人开发者文本处理工具及边缘设备部署。
AI 模型
DeepSeek-R1-Distill-Qwen-14B是基于Qwen架构的14B参数蒸馏语言模型,具备较强复杂任务处理能力与中等资源需求,适用于数据分析、智能推荐、自然语言处理及长文本生成等中等复杂度场景。
AI 模型
DeepSeek-R1-Distill-Qwen-32B 是基于 Qwen2 架构的 32B 参数蒸馏模型,由 DeepSeek 通过知识蒸馏技术将 6710 亿参数的 DeepSeek-R1 教师模型推理能力迁移而来。其核心特点包括:数学推理能力突出(AIME 2024 pass@1 达 72.6%、Math-500 达 94.3%),代码生成表现优异(LiveCodeBench pass@1 57.2%),性能接近 OpenAI-O1。适用于复杂数学问题求解、代码开发辅助及高精度文本推理场景,需 65.7GB VRAM 支持部署。
AI 模型
DeepSeek-R1-Distill-Qwen-7B是基于DeepSeek-R1大模型知识蒸馏的7B参数小型语言模型,继承强化学习优化的推理能力,在数学推理(AIME 2024达55.5%)、编程等任务表现突出,适配边缘设备及低成本推理场景。
AI 模型
DeepSeek-V3是2025年3月发布的AI模型,参数6850亿,属大语言模型。特点:推理与编程能力强,如AIME竞赛题解答、生成高效代码;成本低, 支持消费级设备运行;MIT许可开源。适用于Web开发、数学推理等场景。
AI 模型
DeepSeek-V3.1是中国AI公司DeepSeek于2025年8月发布的大型语言模型,采用混合推理架构与6710亿参数MoE设计,支持""思考""与""非思考""双模式切换,统一通用对话、复杂推理和代码能力。其代理能力强化,可用于工具使用、多步骤推理及编程辅助,已开放API并提供MIT开源许可,适用于智能体开发、金融风控等场景。
字节豆包
Doubao-1.5-lite-32k是字节跳动推出的轻量级通用大模型,属豆包1.5系列。采用MoE架构,以轻量版成本实现原专业版性能,响应快、推理准,适合对时延敏感的简单任务。
字节豆包
Doubao-1.5-pro-32k是字节跳动豆包大模型系列产品,为AI大模型。采用稀疏MoE架构,硬件成本低、推理效率高,多模态能力强,支持视觉理解和实时语音交互,在知识、代码、推理等测评中表现优于GPT-4o等模型,适用于文案生成、智能交互等场景。
字节豆包
Doubao-1.5-thinking-pro 是字节跳动自研的 200B 参数 MoE 架构大语言模型,具备深度推理与低延迟特性。采用「先思后言」路径提升编程、数学等领域推理能力,20 毫秒延迟优化交互流畅度,适用于开发协作、复杂问题求解等场景。
字节豆包
Doubao-1.5-thinking-vision-pro是多模态AI模型,具备视觉理解与深度思考能力,支持图文、语音交互,适用于专业领域推理与创意任务。
字节豆包
豆包1.5·UI-TARS是火山引擎发布的GUI Agent大模型,整合屏幕视觉理解、逻辑推理、界面元素定位与操作能力,突破传统自动化工具依赖预设规则的局限,可驱动图形用户界面交互完成复杂任务,已在火山方舟平台上线。
字节豆包
Doubao-1.5-vision-lite是火山引擎推出的性价比多模态大模型,支持任意分辨率和极端长宽比图像识别,增强视觉推理、文档识别、细节理解和指令遵循能力,适用于图像分析、文档处理等场景。
字节豆包
Doubao-1.5-vision-pro-32k是字节跳动推出的多模态大模型,支持文本、图像输入与输出,具备任意分辨率及极端长宽比图像识别能力,增强视觉推理、文档识别、细节理解和指令遵循能力,最大思维链内容长度32k,适用于复杂视觉任务与长文本交互场景。
Doubao-1.5-vision-pro-32k是字节跳动推出的多模态大模型,支持文本、图像输入与输出,具备任意分辨率及极端长宽比图像识别能力,增强视觉推理、文档识别、细节理解和指令遵循能力,最大思维链内容长度32k,适用于复杂视觉任务与长文本交互场景。
字节豆包
Doubao-embedding是字节跳动研发的语义向量化模型,支持中英双语,输出稠密向量维度2048(可降维至512/1024),适用于语义搜索、推荐系统等场景。其240715版本提升中英文检索效果,升级版Doubao-embedding-large在MTEB和BRIGHT榜单达SOTA,优化推理密集型检索任务。
字节豆包
Doubao-Seed-1.6是字节跳动2025年6月发布的多模态大模型系列,包含主力模型及Flash、Thinking等版本,支持256K上下文,具备深度思考、多模态理解与图形操作能力,已在豆包APP及火山引擎ToB场景上线。
字节豆包
Doubao-Seed-1.6-flash是豆包大模型1.6系列的极速响应型模型,主打低延迟(TPOT仅10ms),支持256K上下文与多模态理解,视觉能力媲美旗舰模型。适用于智能座舱交互、高频咨询、智能硬件等实时场景,助力企业降低延迟60%、成本70%。
字节豆包
Doubao-Seed-1.6-thinking 是豆包大模型1.6系列的深度思考强化版本,属代码与逻辑推理优化型大语言模型。特点为支持256K超长上下文,在数学推理、代码编写等基础能力上显著提升,复杂推理测试达全球前列水平,可独立规划并使用搜索工具完成深度研究任务。适用于复杂业务场景落地,如快速生成专业调研报告、高考级数学解题、高精度代码开发等需强逻辑分析的场景。
字节豆包
Doubao-Seed-1.6-vision 是字节跳动发布的多模态视觉深度思考模型,支持 256K 上下文窗口与工具调用,可自动调用旋转、放大等图像处理工具。适用于视频理解、医疗影像分析、制造业质检等场景,已在豆包 APP 及火山引擎开放。
字节豆包
Doubao-Seed-Translation是字节跳动火山引擎推出的多语言翻译大模型,基于Transformer架构,支持28种语言互译。具备高准确性(BLEU评分42.5)和流畅度,适用于跨境电商、国际合作、教育学习等通用文本翻译场景。
字节豆包
Doubao-SeedEdit-3.0-i2i是图像编辑模型,支持通过自然语言提示进行复杂视觉操作,如背景移除、光线调整和姿势改变,具备随机数种子控制生成随机性的特点,专为商业用途设计,应用于广告、内容创作和电子商务领域。
字节豆包
Doubao-Seedance-1.0-pro是字节跳动推出的视频生成大模型,支持文生/图生视频,输出1080P分辨率,最长10秒。特点:多镜头无缝切换,动态效果自然,主体运动稳定,生成速度快(5秒视频约40秒),成本低(5秒1080P视频3.6元左右)。应用于创意内容制作、营销视频、社交娱乐等场景,通过即梦AI、火山引擎等平台开放。