DeepSeek-V4-Flash 是 DeepSeek 于2026年7月31日正式发布的开源MoE模型(总参数约284B、激活约13B、支持1M上下文),专为编程、工具使用与Agent任务大幅增强,性能在多项基准上超越前预览版甚至V4-Pro预览版,并以MIT协议开源
DeepSeek-V4 拥有百万字超长上下文,在 Agent 能力、世界知识和推理性能上均实现国内与开源领域的领先。
文心5.0是原生全模态大模型.基础能力全面升级,基准测试集表现出色,多模态理解、指令遵循、创意写作、事实性、智能体规划与工具应用等表现尤其出色
GLM-4.7-Flash 是智谱的开源轻量级混合专家(MoE)大模型,在同级别模型中性能达到开源SOTA,尤其擅长编程、智能体任务、复杂推理和中文处理.
GLM-4.6-智谱新一代旗舰模型。核心能力相较 GLM-4.5 实现全面提升,上下文窗口扩展至200K,再次突破开源模型能力边界!
GLM-5.1是智谱AI发布的最新旗舰大模型,代码能力大大增强,编码能力整体对齐Claude Opus 4.6,并在SWE-Bench Pro等基准上取得SOTA表现,支持长达8小时持续迭代执行。
GLM-5.3智谱最新旗舰模型,以极致后训练 Scaling 实现能力跃迁:编程体验较前代提升 50%,网络安全能力持平 Mythos 5
MiniMax M3 是 MiniMax 公司最新发布的开源前沿大模型,具备顶级编码与 Agent 能力、原生多模态(支持图像/视频输入)和高达 100 万 token 的超长上下文。
Kimi K3 是 Kimi 迄今能力最强的模型,拥有 2.8 万亿参数。原生支持视觉理解,并拥有 100 万 token 上下文窗口,面向软件工程、知识工作和深度推理等前沿智能场景而设计。
Doubao-Seed-2.0-pro是旗舰级全能通用模型,面向 Agent 时代的复杂推理与长链路任务执行场景。强调多模态理解、长上下文推理、结构化生成与工具增强执行。复杂指令与多约束执行能力突出,可稳定应对多步复杂规划、复杂图文推理、视频内容理解与高难度分析等场景。
2.4万亿参数MoE旗舰,编程与办公能力全面跃升,可自主编程十数天交付完整项目。胜任法律、金融、设计等数百种专业任务,一次对话端到端交付生产级成果。原生视觉理解贯穿规划、执行与验证全流程,支持超长文档与长视频的深度语义解析。长程任务中自主规划与闭环迭代,持续进化。
Grok 4.6 是 xAI(现 SpaceXAI)于 2026 年 8 月发布的前沿大模型,基于 Grok 4.5 加强长期代理任务、编码与复杂交互能力,在多项基准上达到与 GPT-5.6 Sol 相当的前沿水平
Grok 4.20 Beta 是 Grok 最新的旗舰型号,具备行业领先的速度和智能工具调用能力。它结合了市场上最低的幻觉率与严格的提示遵循性,能够持续提供精准且真实可靠的回复。
Claude Sonnet 5 是 Anthropic 于 2026 年 6 月底发布的最新 Sonnet 系列模型,是目前最具代理能力(agentic)的中端模型,在编码、工具使用、推理和知识工作上大幅超越前代 Sonnet 4.6,性能接近 Opus 级别,却保持更快的速度和更低的价格
Claude Opus 4.6 在编程、代理任务和专业知识工作上大幅超越前代,具有超大规模代码库处理可靠性,被誉为当前 coding 和 agent 最强的 AI 模型
Claude Opus 5 是 Anthropic 于 2026 年 7 月发布的高效旗舰模型,在编码与知识工作任务上达到接近其更高端 Fable 5 的前沿智能水平,却仅需一半价格,并成为 Claude Max 的默认模型。
Claude Fable 5 是 Anthropic 推出的 Mythos-class 最强通用发布模型,专为高难度推理、长时序智能体任务(如软件工程、科研和复杂知识工作)设计,具有顶尖基准表现并配备安全防护。
Gemini 3.7 Flash是谷歌于2026年8月发布的Gemini 3系列最新高效工作模型,专为复杂编程与智能体任务设计,具备更强推理能力、1M上下文窗口,并以半价优惠($0.75/百万输入令牌)提供生产级性能
Gemini-3.1-pro-preview 是 Google 于 2026 年 2 月 19 日发布的 Gemini 3 系列前沿预览模型,专注于大幅提升复杂推理能力、token 效率、事实一致性和软件工程表现,特别适合 agentic workflows、多模态长上下文任务,是当前 Google 最先进的推理大模型之一。
GPT-5.6 Luna 专为高并发、低成本场景打造,是极致性价比之选。性能定位相当于早期 GPT-5 系列中的 nano 模型层级,适合大规模、轻量化的任务处理。
GPT-5.6 Sol是OpenAI于2026年发布的GPT-5.6系列旗舰模型,作为其目前最强大的AI,擅长复杂编码、长时序代理任务、生物学和网络安全等领域,并引入了max reasoning和ultra mode等新功能,在Terminal-Bench 2.1等基准上创下新纪录。
GPT-5.5是OpenAI于2026年4月23日发布的最新旗舰大模型,被称为“为真实工作而生的新型智能”,在编码、复杂任务自主执行、数据分析和计算机操作等方面显著提升,更智能、直观且代理能力(agentic)更强。
Nano Banana Pro 是 Google 2025年11月20日发布的 Gemini 3 Pro Image 模型,专注工作室级高保真图像生成、编辑与多语言精确文字渲染.
Nano Banana 2(Gemini 3.1 Flash Image)是谷歌 DeepMind 最新推出的尖端 AI 图像生成与编辑模型,融合了 Nano Banana Pro 的高保真品质、精准文字渲染与多参考图像理解能力,以及 Gemini Flash 的极致生成速度,支持最高 4K 输出和实时世界知识 grounding,已成为 Gemini App 默认图像模型。.
Z-Image-Turbo:通义实验室图像生成模型Z-Image的精炼版本.它在照片级真实感图像生成、中英文本渲染以及稳健指令遵循方面表现出色
可图大模型能够基于开放式文本生成风格多样、画质精美、创意十足的绘画作品,让用户轻松高效地完成艺术创作
MiniMax Image-01大模型实现精准提示控制,支持电影级光影构图与材质还原,且成本仅为行业方案的十分之一,是AI视觉创作领域的颠覆性工具。
seedream-5.0-pro是字节跳动发布的最新图像创作模型。该模型在更复杂、更真实的图像生成与编辑需求维度全面升级,将图像创作推进到可控生产的新阶段。本次模型更新的主要亮点是编辑更可控、生产更落地、效果更自然。
GPT Image 2 是OpenAI先进的图像生成模型,支持快速、高质量的图像生成和编辑。它支持灵活的图像尺寸和高保真图像输入。特别对中文的处理有质的提升
CogView-4在图像生成方面表现出色,能够更准确地理解指令,语义理解、生成质量全面提升,汉字生成能力增强!DPG-Bench 综合评分排名第一
CogView-3-Flash 是智谱推出的免费图像生成模型,能够根据用户指令生成符合要求且美学评分更高的图像
CogVideoX-3 画面稳定度、清晰度大幅提升,主体大幅度运动流畅自然,指令遵循与物理真实模拟更佳,还提升了高清现实及 3D 风格场景表现。
CogVideoX-Flash 是智谱推出的免费视频生成模型,能够根据用户指令生成符合要求且美学评分更高的视频
Gemini-2.5-pro-preview-tts 专注于高质量、可控的语音生成,支持丰富的语气、节奏、多说话人对话以及复杂提示下的自然表达,适用于高端音频创作
MiniMax Speech 2.8 HD 是 MiniMax 推出的文本转语音级旗舰产品,核心定位为“提供录音棚级高保真音质的专业语音合成 API”,以极致清晰度与自然度满足高端音频制作需求。
Suno v5.5 是 Suno 目前最强大、最具表现力的 AI 音乐生成模型,强调“更具个人特色”,新增 Voices(个人声线克隆)、Custom Models(自定义风格模型)和 My Taste 等个性化功能,让生成的音乐更能体现创作者自己的声音和风格。
MiniMax Music 3.0:语义理解模型升级,更懂创作意图。音质全面跃升:一键触达商业唱片级听感。人声合成更自然:逼近真人录音室表现。
Mureka V9是昆仑万维最新AI音乐大模型,以MusiCoT音乐思维链技术为核心,能精准理解创作意图,快速将文本提示生成结构完整、歌词人声与编曲协调的高质量歌曲,在可控性和音乐性上达到业界领先水平
Ollama 支持运行本地各种开源大模型,如LLaMA、Mistral、Gemma、Qwen等,并支持运行私有模型。
基于RAG(检索增强生成)与向量嵌入架构的大模型智能助手,为您提供精准高效的私有知识库问答服务。
全栈AI助手是国内较早接入并适配OpenAI ChatGPT的智能问答系统之一,能够理解并回应用户提出的自然语言问题,与用户进行互动交流。它擅长解答技术、编程、数学、自然科学以及文化娱乐等领域的问题,广泛应用于在线客服、智能问答、聊天机器人和自然语言处理等场景。该系统能高效解决与语言交互相关的各类问题,例如提供技术支持或解答人文社科类问题。随着人工智能和自然语言处理技术的进步,其功能和应用范围将持续扩展。《服务条款》