JiMeng / 即梦3.0-文生视频-720PAPI ID:bytedance/jimeng_t2v_v30视频生成视频与3D即梦最新发布视频3.0模型,最大特点是2个:非常强的质量遵循能力和多镜头运镜、切换能力。
Anthropic / Claude-3.7-sonnet(Thinking)API ID:anthropic/claude-3.7-sonnet:thinking文本编程数学与科学多模态理解编程文档与办公学术与教育Claude-3.7-sonnet(Thinking)是Anthropic于 2025 年推出的新一代思维型大语言模型。该模型首次融合自回归生成与符号推理架构,具备多步骤思维展示、自我纠错能力以及长达 10 万 tokens 的上下文理解能力,标志着AI从简单生成向深度逻辑推理与透明思考的跨越。
Tencent / Hunyuan-T1-VisionAPI ID:tencent/hunyuan-t1-vision文本多模态理解图像与设计文档与办公对话与客服采用混元MOE结构,是混元最新多模态模型,支持多语种作答,中英文能力均衡。
DeepSeek / DeepSeek-R1-0528API ID:deepseek/deepseek-r1-0528文本编程翻译编程数学与科学DeepSeek R1-0528是DeepSeek R1模型的小版本升级版。通过增加计算资源和引入后训练阶段的算法优化,DeepSeek R1-0528显著提升了推理与推断的深度和能力。该模型在数学、编程及一般逻辑等多项基准测试中表现优异,整体性能已接近业内领先的 O3和Gemini 2.5 Pro模型,展现出强大的多领域应用潜力。
MiniMax / MiniMax-M1API ID:minimax/minimax-m1文本数学与科学编程多模态理解MiniMax-M1,世界上第一个开源的大规模混合架构的推理模型,适合在复杂场景中使用。
bigmodel / GLM-4.5-AirAPI ID:bigmodel/glm-4.5-air文本对话与客服编程文档与办公内容创作智能代理与数据GLM-4.5-Air为GLM-4.5的轻量版,兼顾性能与性价比,可灵活切换混合思考模型。
bigmodel / GLM-4.5-XAPI ID:bigmodel/glm-4.5-x文本对话与客服编程文档与办公内容创作翻译GLM-4.5-X为GLM-4.5的极速版,在性能强劲的同时,生成速度可达100tokens/秒。
bigmodel / GLM-4.5-Air ThinkingAPI ID:bigmodel/glm-4.5-air:thinking文本数学与科学编程智能代理与数据对话与客服文档与办公GLM-4.5-Air为GLM-4.5的轻量版,兼顾性能与性价比,可灵活切换混合思考模型。
bigmodel / GLM-4.5-X ThinkingAPI ID:bigmodel/glm-4.5-x:thinking文本对话与客服文档与办公编程内容创作学术与教育GLM-4.5-X为GLM-4.5的极速版,在性能强劲的同时,生成速度可达100tokens/秒。
Ali / Qwen3-235B-A22B-Instruct-2507API ID:ali/qwen3-235b-a22b-instruct-2507文本编程数学与科学多模态理解文档与办公翻译Qwen3-235B-A22B-Instruct-2507是Qwen3-235B-A22B-FP8的增强版本,在指令遵循、逻辑推理、文本理解、数学与编程能力、多语言知识覆盖等方面表现显著提升,并在256K长上下文处理和主观任务对齐度上进一步优化,生成内容更高质量、更贴近用户意图。
bigmodel / GLM-4.5-AirX ThinkingAPI ID:bigmodel/glm-4.5-airx:thinking文本对话与客服编程数学与科学GLM-4.5-AirX为GLM-4.5-Air的极速版,响应速度更快,专为大规模高速度需求打造。
Vidu / Vidu1.5API ID:vidu/vidu1.5视频生成视频与3Dvidu/vidu1.5是生数科技推出的多模态AI视频生成模型,核心突破多主体一致性难题,上传1-3张参考图即可精准控制人物、物体及场景融合,无需LoRA微调。支持文生、图生、参考生视频,输出最高1080P分辨率,30秒内即可出片。具备上下文理解能力,适配写实、动漫风格,广泛应用于影视预制作、广告创作、动漫开发等场景。
Anthropic / Claude 3.5 HaikuAPI ID:anthropic/claude-3.5-haiku文本多模态理解对话与客服内容创作文档与办公编程Claude 3.5 Haiku是Anthropic最快且最具成本效益的下一代模型,非常适合速度和经济性重要的应用场景。
Ali / Qwen3.5-9BAPI ID:ali/qwen3.5-9b文本Qwen3.5-9B 是 Qwen3.5 系列中的多模态基础模型,旨在以高效的 9B 参数架构提供强大的推理、编码和视觉理解能力。它采用统一的视觉语言设计,并早期融合多模态标记,使模型能够在同一上下文中处理和推理文本和图像。
Moonshot / Kimi-latestAPI ID:moonshot/kimi-latest文本多模态理解文档与办公对话与客服内容创作学术与教育Kimi-latest是一个最长支持128k上下文的视觉模型,支持图片理解。同时,kimi-latest 模型总是使用Kimi智能助手产品使用最新的Kimi 大模型版本,可能包含尚未稳定的特性。
Ali / Qwen3-235B-A22B-Thinking-2507API ID:ali/qwen3-235b-a22b-thinking-2507文本数学与科学多模态理解内容创作学术与教育文档与办公基于Qwen3的思考模式开源模型,相较通义千问3-235B-A22B逻辑能力、通用能力、知识增强及创作能力均有大幅提升,适用于高难度强推理场景。
Google / Gemini 2.5 Flash Nativa AudioAPI ID:google/gemini-2.5-flash-live文本语音处理对话与客服多模态理解翻译Gemini 2.5 Flash 的原生音频模型,支持Live API格式调用。
Vidu / ViduQ1API ID:vidu/viduq1视频生成视频与3D主打高可控性与电影级画质。支持文生、图生、参考生三重模式,可输入7张参考图精准控制多主体一致性,生成1080P分辨率视频,动态过渡自然且符合物理规律。其首尾帧功能仅需两张图即可实现电影级运镜,音频生成支持48KHz高保真采样,同步精度达±0.1秒。在VBench测评中,该模型以绝对优势超越Sora、Runway等国际竞品,稳居文生/图生视频双榜首。凭借每秒0.3元的低成本与10秒极速生成能力,ViduQ1广泛应用于电商广告、影视预制作、动漫开发等场景,推动AI视频从创意工具向生产力引擎升级。
InternLM / Intern-S2-PreviewAPI ID:intern/intern-s2-preview文本我们最新发布的 35B-A3B 科学多模态推理模型,支持 256K 上下文窗口;通过任务 scaling 与架构优化,重点提升科学发现和通用智能体能力。
baidu / ERNIE-4.0-Turbo-128KAPI ID:baidu/ernie-4.0-turbo-128k文本文档与办公多模态理解内容创作编程学术与教育百度自研的旗舰级超大规模⼤语⾔模型,综合效果表现出色,广泛适用于各领域复杂任务场景;支持自动对接百度搜索插件,保障问答信息时效。相较于ERNIE 4.0在性能表现上更优秀
bigmodel / GLM-4.5-AirXAPI ID:bigmodel/glm-4.5-airx文本对话与客服内容创作文档与办公GLM-4.5-AirX为GLM-4.5-Air的极速版,响应速度更快,专为大规模高速度需求打造。