← 返回 AIGC教程
大模型 今天

2026年主流大模型汇总2026.08.07

2026年主流大模型汇总(截至2026.08.14),按发布时间梳理大厂旗舰主力模型的定位与能力。

2026年主流大模型汇总2026.08.07

吉林市博晓职业技能培训学校 | 2026.08.07

说明:统计大厂旗舰主力模型,不含小版本微调迭代,按发布时间排序

发布时间 公司 / 模型名称 模型能力与作用
2026‑01‑22 百度 · 文心5.0正式版 原生全模态大模型,2.4万亿参数;文本、图像、音频、视频统一建模;支持多模态输入输出,面向C端对话、企业千帆平台调用,行业垂直落地(政务、工业、医疗)。
2026‑01‑26 阿里巴巴(通义千问) · Qwen3‑Max‑Thinking 旗舰推理大模型;内置工具调用、记忆、代码解释器;擅长复杂逻辑推理,支持网页/PC客户端,面向通用对话、企业API调用。
2026‑01‑27 月之暗面Kimi · Kimi K2.5 超长上下文通用大模型;强化Agent智能体、代码、图像、视频能力;擅长百万级长文档解析,开源权重,适合文档处理、企业知识库场景。
2026‑01‑31 快手 · 可灵3.0 / 3.0 Omni 视频生成大模型;长视频生成、图像转视频、视频编辑;面向短视频创作、数字内容生产。
2026‑02‑11 智谱AI · GLM‑5 开源通用旗舰大模型;DSA稀疏注意力,强化多智能体协作、工程级代码开发;支持国产芯片适配,MIT开源,适合私有化部署、软件开发Agent。
2026‑02‑11 科大讯飞 · 星火X2 全国产算力训练多模态大模型;语音能力极强,优化教育测评、医疗病历、政务、车载语音;面向C端助手、企业行业解决方案。
2026‑02‑14 字节跳动 · Seed 2.0 / Seed 2.0 Pro(豆包底层基座) 字节自研通用基座大模型;文本、逻辑、工具调用、多模态;支撑豆包C端产品、飞书、火山引擎企业服务;配套Seedance2.0视频、Seedream5.0 Lite图像生成模型。
2026‑02‑27 阿里巴巴 · Qwen3.5系列 MoE高效架构,覆盖轻量‑中大型;支持256K上下文、201种语言;端侧到云端全覆盖,大量开源版本,适合端设备、私有化部署、二次微调。
2026‑04‑23 腾讯 · 混元Hy3 Preview MoE架构快慢思考融合;深度打通微信生态,社交理解、多模态、代码工具调用;面向企业API、微信AI助手、CodeBuddy开发助手,部分权重开源。
2026‑04‑24 DeepSeek · DeepSeek‑V4 Pro / V4 Flash 开源旗舰大模型;推理、数学、代码能力突出;Flash主打高速低成本推理,适合开发者、私有化部署。
2026‑04‑28 小米 · MiMo V2.5 Pro 端云协同大模型;侧重手机端侧部署,轻量化多模态;面向小米手机、IoT硬件本地AI助手。
2026‑05‑19 Google · Gemini 3.5系列+Gemini Omni 谷歌原生多模态旗舰;长上下文、复杂科研推理、音视频理解;面向Google搜索、Pixel终端、Google云。
2026‑05‑20 百度 · 文心5.1 文心5.0迭代升级;降低训练推理成本,强化Agent智能体、知识库;千帆平台企业服务,行业模型基座。
2026‑06‑01 MiniMax(稀宇科技) · MiniMax M3 通用语言基座大模型;自研MSA稀疏注意力,原生100万token超长上下文,擅长代码开发、Agent智能体、图文理解;不输出视频;是H3视频模型内部语言理解内核;支持开源权重、API调用,海螺AI底层语言基座。
2026‑06‑16 智谱AI · GLM‑5.2 开源长上下文旗舰;1M超长上下文,工程编程能力大幅增强;面向企业长文档、软件研发智能体,MIT协议开源。
2026‑07‑08 字节跳动 · Seedream 5.0 Pro 专业图像创作大模型;复杂信息可视化、像素级交互式编辑、高质量人像摄影、多语种图文生成;海报、UI、科普可视化内容生产。
2026‑07‑09 OpenAI · GPT‑5.6系列(Sol / Terra / Luna) 海外闭源旗舰;Sol面向科研、复杂工程;Terra均衡日常办公;Luna高速低成本;支持多Agent并行协作,软件开发、文档、科研辅助,ChatGPT与API提供服务。
2026‑07‑16 月之暗面Kimi · Kimi K3 2.8万亿参数,全球最大开源基座大模型;原生视觉,100万token超长上下文;编程能力全球顶尖,擅长软件工程、深度研究、复杂推理;完整权重开源,可私有化部署,C端Kimi App、API开放调用。
2026‑07‑20 腾讯 · 混元Hy3正式版 Hy3 Preview迭代正式版本;优化多模态视频理解、工具调用;腾讯云对外开放,面向ToB企业客户。
2026‑07‑31 MiniMax(稀宇科技) · MiniMax H3 通用全模态视频大模型,8月3日正式开源;文本/图像/音频/视频多模态统一输入输出;原生2K分辨率,最长15秒立体声视频生成;擅长视频编辑、动作迁移,主打广告、电商、品牌商业内容生产,推理成本优势显著。
2026‑07‑31 字节跳动 · Seedance 2.5 视频生成大模型(Seedance 2.0 升级版);单次生成时长 15 秒→30 秒并支持多轮时序延长,可生成数分钟连贯多镜头叙事;多模态参考最多 50 个(30 图+10 视频+10 音频),新增白模/绿幕参考;视频局部编辑+精准时间戳控制;原生 10+ 语言;已上线豆包、即梦、扣子、小云雀,近期经火山引擎开放企业 API。
2026‑08‑03 阿里巴巴 · Qwen3.8‑Max 阿里新一代旗舰基座;强化智能体Agent能力,长上下文、多模态;通义千问C端、魔搭社区、企业API。
2026‑08‑06 阿里巴巴(通义万相) · Wan3.0 新一代视频生成大模型,公测上线;单次原生生成30秒长视频,支持一镜到底复杂运镜;首创支持pdf/doc/ppt/xls/md文档直接输入生成视频;支持文/图/音/视频多参考输入,强角色一致性,人像细节真实;面向课件、产品宣传片、短视频商业内容,阿里云百炼开放API调用。
2026‑08‑07 MiniMax · Music3 音乐生成模型;输入歌词与音乐描述即可生成最长 5 分钟完整歌曲,输出 32kHz/16-bit 立体声 WAV;采用分层自回归架构(全局语言模型 8B,由 Qwen3-8B 初始化)。
2026‑08‑08 xAI · Grok Imagine Image 2.0 图像生成模型;Grok 系列图像生成升级版。
2026‑08‑10 Meta · Muse Glimmer 30B 开源大语言模型(Apache 2.0);约 30B 稠密模型,面向本地智能体编程(SWE-Bench Verified 76.0),个人电脑可跑;标志 Meta 转向开源。
2026‑08‑10 字节跳动 · Seed 2.1 Turbo 语言模型(高速版);豆包 Seed 系列高速推理变体。
2026‑08‑10 OpenAI · GPT-5.6 Cyber 大语言模型(安全/网络向变体);GPT-5.6 家族网络安全专用版本。
2026‑08‑11 Anthropic · Claude Fable 5 旗舰大语言模型;Anthropic 新旗舰,编程与智能体能力对标前沿(多款模型以“接近 Fable 5”为参照)。
2026‑08‑12 xAI · Grok 4.6 旗舰大语言模型;500K 上下文、多模态,Artificial Analysis 智能指数 61(全球第四),API \$2/\$6 per 1M tokens。
2026‑08‑13 DeepSeek · V4 Pro 0813 大语言模型(MIT 开源);1.6T MoE、49B 激活、1M 上下文,Agent 能力大涨(DeepSWE 从 12.8 升至 62.7),原生支持 OpenAI Responses API 格式。
2026‑08‑13 Google · Gemini 3.7 Flash 大语言模型;强化编码与 Agent 工作流,向 Pro/Ultra 用户开放。
2026‑08‑14 阿里 · Qwen3.8-2.4T-A95B 开源大语言模型;首次开放 Max 级旗舰权重(2.4T 总参、95B 激活),适配平头哥/升腾/摩尔线程等国产芯片。
2026‑08‑14 阿里 · Qwen3.8-27B 开源多模态稠密模型;27B 参数原生多模态,性能超越 Qwen3.7-Plus,支持 262K 上下文(可扩至 1M),消费级显卡可跑。
2026‑08‑14 智谱 · GLM-5.3 大语言模型(开源);740B 参数,纯后训练使性能较 GLM-5.2 提升约 50%,编程逼近 Fable 5,开源编程第一,承诺两周内开放权重。