模型广场
Kimi K3
Kimi K3 是 Kimi 迄今能力最强的旗舰模型,拥有 2.8 万亿参数,基于 KDA 混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建,原生支持视觉理解,并拥有 100 万 token 上下文窗口。它是全球首个开源的 3 万亿级别模型,面向长程编程、知识工作和推理等前沿智能场景而设计。
Kimi K2.7 Code HighSpeed
Kimi K2.7 Code 高速版(kimi-k2.7-code-highspeed),与 Kimi K2.7 Code 是同一个模型,但输出速度约为普通版的 5-6 倍,常规编程场景下(取输入长度中位数)输出速度约 180 Token/s,短上下文场景可达 260 Token/s ,支持 256K 上下文窗口,带来更极致的编程体验。
Kimi K2.7 Code
Kimi K2.7 Code 是 Kimi 迄今最智能的 Coding 模型,在长上下文中更可靠地遵循指令,能以更高的成功率完成编程任务,同时支持文本、图片与视频输入,思考模式,对话与 Agent 任务。
MiniMax M2.7 HighSpeed
MiniMax M2.7-highspeed 是专为追求极致效率的生产力场景打造的加速版 SOTA 模型。 它完美继承了 M2.7 的核心智能与强大的数字化工作能力——通过多智能体协作,主动参与自身演进,并将先进的智能体能力整合其中,使其能够在动态环境中规划、执行并改进复杂任务,能够处理诸如实时调试、根因分析、财务建模,以及跨 Word、Excel 和 PowerPoint 的完整文档生成等工作流程。
MiniMax M2.7
MiniMax-M2.7 是一款面向自主化、真实生产力与持续进化的下一代大语言模型。该模型深度参与自身演化进程,通过多智能体协同整合先进的智能体能力,能够在动态环境中完成复杂任务的规划、执行与优化。
MiniMax M2.5 HighSpeed
MiniMax M2.5-highspeed 是专为追求极致效率的生产力场景打造的加速版 SOTA 模型。 它完美继承了 M2.5 的核心智能与强大的数字化工作能力——包括在 SWE-Bench Verified 斩获 80.2% 的编程实力、流畅操作 Office 全家桶的办公通用性,以及复杂环境下的跨软件协作能力。
MiniMax M2.5
Minimax M2.5专为Agent场景原生设计,编程与智能体性能(Coding & Agentic)直接对标Claude Opus 4.6,尤其在Excel高阶处理、PPT生成和深度调研等Office生产力场景达到行业领先水平(SOTA)。
DeepSeek V3.2
DeepSeek 发布 V3.2 正式版,显著强化了 Agent 和推理能力,在主流测试中达到 GPT-5 水平并支持思考模式下的工具调用;同时推出的 Speciale 探索版在多项国际竞赛中取得金牌级表现。模型已全面开放使用。
DeepSeek V3.1
DeepSeek V3.1 通过显式推理(Think)、动态搜索(Search)、高效工具调用(Tool) 这三驾马车,清晰地瞄准了下一代 AI 智能体的核心能力,清晰地勾勒出一条技术演进路线:一个更自主、更可靠、更能与外部世界交互的智能体(Agent)正在成型。
DouBao-Seed-2.0-Pro
Doubao Seed 2.0 Pro 旗舰级全能通用模型,面向 Agent 时代的复杂推理与长链路任务执行场景。强调多模态理解、长上下文推理、结构化生成与工具增强执行。复杂指令与多约束执行能力突出,可稳定应对多步复杂规划、复杂图文推理、视频内容理解与高难度分析等场景。
Qwen3.7-Max
Qwen3.7系列中规模最大、综合能力最强的Max模型,当前开放纯文本模型能力供体验。Qwen3.7是面向智能体时代的新一代旗舰模型,核心优势在于智能体能力的广度与深度:在编程、办公与生产力、长周期自主执行方面均能出色胜任各项任务。
GLM-5.2
GLM-5.2 是智谱面向长任务时代的旗舰模型。支持真正可用的 1M 上下文,可承载项目级工程上下文,长程任务执行更稳定、工程规范遵循更可靠,一次任务即可完成从需求到多端部署的完整开发链路。
DouBao-Seed-2.0-Code
Doubao-Seed-2.0-Code 面向企业级编程需求优化,在 Seed 2.0 优秀的 Agent、VLM 能力基础上,特别增强了代码能力,不仅前端能力表现出众,也对企业常见的多语言编码需求做了特别优化,适合接入各种 AI 编程工具使用。
DouBao-Seed-1.6-Flash
Doubao-Seed-1.6-flash 推理速度极致的多模态深度思考模型,TPOT低至10ms; 同时支持文本和视觉理解,文本理解能力超过上一代lite,视觉理解比肩友商pro系列模型。支持 256k 上下文窗口,输出长度支持最大 16k tokens。
阶跃星辰Step-3.5-Flash
Step 3.5 Flash 是由 StepFun 开发的一款稀疏混合专家(MoE)大语言模型,旨在以卓越的效率提供前沿推理与智能体能力。该模型总参数量为 1968.1 亿,但每个 token 仅激活约 110 亿参数,在具备顶级模型推理深度的同时,仍能保持 100-300 token/秒(编码任务峰值可达 350 token/秒)的吞吐量,实现实时响应。
Qwen3-Coder-480B-A35B-Instruct
Qwen3-Coder-480B-A35B-Instruct 是一款专为代码生成与智能体编码任务设计的最先进的大语言模型。该模型采用混合专家(MoE)架构,总参数量为 4800 亿,激活参数量为 350 亿,原生支持 262,144 个 token 的上下文长度,并可通过 YaRN 方法扩展至 100 万个 token。
GLM-Z1-Flash
核心定位:一款轻量级、高速的免费推理模型,旨在降低使用门槛。 擅长领域:在数学逻辑推理、代码生成、长文档处理等复杂任务上表现出色。
GLM-4.6V-Flash
GLM-4.6V-Flash 是 GLM-4.6V 的免费版本,是 GLM 系列在多模态方向上的一次重要迭代,支持开启或关闭思考模式。它将训练时上下文窗口提升到128k tokens,在 视觉理解精度上达到同参数规模 SOTA,并首次在模型架构中将 Function Call(工具调用)能力原生融入视觉模型,打通从「视觉感知」到「可执行行动(Action)」的链路,为真实业务场景中的多模态 Agent 提供统一的技术底座。适用于图片OCR信息提取、图片内容理解与其相关属性提取,多模态时序融合、动态内容分析
GLM-4.7-Flash
最新基座模型的普惠版本。GLM-4.7-Flash 作为 30B 级 SOTA 模型,提供了一个兼顾性能与效率的新选择。面向 Agentic Coding 场景强化了编码能力、长程任务规划与工具协同,并在多个公开基准的当期榜单中取得同尺寸开源模型中的出色表现。在执行复杂智能体任务,在工具调用时指令遵循更强,Artifacts 与 Agentic Coding 的前端美感和长程任务完成效率进一步提升。
DeepSeek-V4-Pro
DeepSeek-V4-Pro 是 DeepSeek 于 2026年4月发布的第四代旗舰大语言模型(总参数未公开,激活参数约70-100B)。它采用混合专家(MoE)架构与创新的混合注意力机制(CSA+HCA),原生支持 1M token 超长上下文。
DeepSeek-V4-Flash
DeepSeek-V4-Flash 是 DeepSeek 于 2026年4月推出的高效能大语言模型(304B参数,激活13B)。它主打极低延迟与超高性价比,原生支持100万token超长上下文(可处理整本书),在长文本任务中的算力需求仅为旗舰版的10%。
Kimi K2.5
Kimi K2.5 支持文本、图片与视频输入,思考与非思考模式,对话与 Agent 任务
Kimi K2.6
Kimi K2.6 是 Kimi 最新最智能的模型,Kimi K2.6 的通用 Agent、代码、视觉理解等综合能力得到全面提升,其中在博士级难度的完整版人类最后的考试(Humanity’s Last Exam)、在考察模型真实软件工程能力的 SWE-Bench Pro、评估 Agent 深度检索能力的 DeepSearchQA 等基准测试中均取得行业领先的成绩,同时支持文本、图片与视频输入,思考与非思考模式,对话与 Agent 任务。
模型详情
-
-
-