模型广场
汇聚国内外 100+ 款主流 AI 大模型,统一接口、即接即用。
Hy4 preview
混元Hy4 preview总参数770B、激活参数49B,重点面向Agent、Coding与生产力场景优化,强化复杂任务中的理解、规划、工具调用与持续执行能力。相比上一代模型,Hy4 preview在多步骤Agent、代码开发和生产力任务上进一步提升,具备更好的任务拆解、上下文承接、指令遵循和长链路执行能力。在Coding场景中,进一步增强代码理解、生成、修改和复杂工程任务处理能力;在生产力场景中,重点提升文档处理、信息分析、办公自动化、游戏开发、网页生成及跨工具协作等能力。Hy4 preview适用于Coding Agent、复杂工具调用以及各类需要多步骤规划和持续执行的Agent工作流,为真实业务场景中的复杂任务提供更可靠的任务完成能力。
ERNIE 5.0
文心新一代模型文心5.0是原生全模态大模型,采用原生的全模态统一建模技术,将文本、图像、音频、视频联合建模,具备综合的全模态能力。文心5.0基础能力全面升级,基准测试集表现出色,多模态理解、指令遵循、创意写作、事实性、智能体规划与工具应用等表现尤其出色。
ERNIE 5.1
ERNIE 5.1是文心系列最新模型,基础能力全面升级,在智能体、知识、推理、深度搜索等方面均有显著提升。此次升级发布,采用分离式全异步强化学习技术,针对性解决大模型向智能体自主决策演进中面临的训推数值偏差、异构资源利用率低及长尾效应导致的全局等挑战。配套采用规模化智能体后训练技术来提升模型能力与泛化表现,让环境、专家、融合三步协同 ,既保证了训练效率,也显著提升模型在复杂任务中的稳定性与表现。
glm-5.3-flash
GLM-5.3-Flash 基于一个全新训练的基础模型构建,其架构和训练方案围绕能力与效率进行了重新设计。GLM 系列首次引入了稀疏注意力与线性注意力相结合的混合架构,在显著降低长上下文推理成本的同时,保留了精准的长上下文处理能力。模型还采用了流形约束超连接(Manifold-Constrained Hyper-Connections, mHC),进一步提升了扩展效率。结合我们最新的 30T token 多模态预训练语料库,这些改进使 GLM-5.3-Flash 能以更少的计算资源提供更强的智能表现。
qwen3.8-flash
Qwen3.8-Flash 是千问最新推出的多模态大模型,兼具强大的理解与生成能力和出色的响应速度。模型原生支持百万级上下文窗口,能够一次性处理超长文档、代码仓库和复杂对话。在编程辅助、智能体协作、图文理解等场景中表现尤为出色——无论是自动修复代码、操作桌面应用,还是分析图表与长视频,都能给出准确、高质量的结果。同时兼容 OpenAI 与 Anthropic 主流接口协议,可无缝接入 Claude Code、Codex 等开发者工具,轻松构建高并发应用与智能工作流。凭借优异的性能与极具竞争力的推理成本,Qwen3.8-Flash 是开发者和企业在 AI 应用中兼顾效果与效率的理想选择。
Doubao-Seed-2.0-Code
面向真实编程环境优化的 Coding 模型,能稳定调用 Claude Code 等常见 IDE 中的工具。模型特别优化了前端能力,在使用常见的前端框架时能有良好表现。模型支持使用 Skills,可以配合多种自定义技能使用。
Doubao-Seed-2.0-pro
豆包大模型2.0是全新一代的多模态模型,在智力水平、企业应用与面向未来复杂任务的规划与执行能力上实现全方位跃迁。模型更聪明、更稳定、Tokens效率更高,通过pro、lite、mini全系列尺寸,为不同规模与复杂度的应用场景提供专业级支持。
wan3.0-video
万相3.0是 all-in-one 视频生成模型,统一支持参考、编辑、复刻、驱动等多种创作功能,四模态全能参考,最长支持30秒视频生成,可解析文件、网页及复杂图片。生产级角色一致性保持,音画真实,带来身临其境的视听冲击力。
wan3.0-video-prime
Wan3.0-Video-Prime 是万相3.0 的高速版视频生成模型,能力对齐 Wan3.0-Video 标准版,支持四模态全能参考,最长可生成30秒视频,带来沉浸式视听体验的同时端到端速度显著提升。
volc03/doubao-seedance-2-0-260128
Seedance 2.0 是豆包大模型团队推出的新一代专业级多模态创作视频模型。 支持图像、视频、音频等多种模态作为参考输入生成视频,打破单一素材的创作局限,同时具备视频编辑、视频延长等能力,可高精度还原物品细节、材质、音色、视效风格、运镜等,角色特征亦可稳定保持,赋予创作者如同导演般的掌控权。 Seedance 2.0 具备极致拟真的视听稳定性:凭借出色的运动稳定性及画面细节,呈现媲美实拍的影像质感与虚实难辨的视觉冲击。拥有复杂场景的驾驭力,从细腻微表情、激烈肢体对抗,再到富有张力的歌舞,皆能生动还原。同时自带专业运镜、多镜头叙事与文字生成能力,增强叙事张力。原生音画同出,精准匹配视觉生成丰富音效,支持多语种、口音及方言演绎,赋予视频极致的完整度与沉浸感。 Seedance 2.0 深度适配商业广告、影视制作与社交媒体营销三大核心场景。通过工业级标准的生成质量,抽卡成功率大幅提升,降低高品质内容的制作门槛与成本,优化从创意到成片的生产流程,为行业带来显著的效率提升。
volc03/doubao-seedance-2-0-fast-260128
Seedance 2.0 是豆包大模型团队推出的新一代专业级多模态创作视频模型。 支持图像、视频、音频等多种模态作为参考输入生成视频,打破单一素材的创作局限,同时具备视频编辑、视频延长等能力,可高精度还原物品细节、材质、音色、视效风格、运镜等,角色特征亦可稳定保持,赋予创作者如同导演般的掌控权。 Seedance 2.0 具备极致拟真的视听稳定性:凭借出色的运动稳定性及画面细节,呈现媲美实拍的影像质感与虚实难辨的视觉冲击。拥有复杂场景的驾驭力,从细腻微表情、激烈肢体对抗,再到富有张力的歌舞,皆能生动还原。同时自带专业运镜、多镜头叙事与文字生成能力,增强叙事张力。原生音画同出,精准匹配视觉生成丰富音效,支持多语种、口音及方言演绎,赋予视频极致的完整度与沉浸感。 Seedance 2.0 深度适配商业广告、影视制作与社交媒体营销三大核心场景。通过工业级标准的生成质量,抽卡成功率大幅提升,降低高品质内容的制作门槛与成本,优化从创意到成片的生产流程,为行业带来显著的效率提升。
volc03/doubao-seedance-2-0-mini-260615
Seedance 2.0 mini 是面向更广泛视频生成需求推出的新一代高性价比视频生成模型。在保持竞争力效果的同时,将视频生成能力带入更低门槛、更高频、更规模化的应用场景
volc03/doubao-seedance-2-5-260628
Seedance-2.5 是豆包大模型团队推出的,新一代专业级多模态视频创作模型。模型支持单段 30 秒视频直出,单次最多可输入50个参考素材(30张图+10个视频+10个音频),具备更强的指令控制,专业级可控的视频编辑与延长能力;同时,原生支持生成 10 余种语言 ,保障专业级叙事在全球化场景中稳定落地,让视频生成 迈入「长叙事 × 强参考 × 准编辑 × 多语言」的工业级新阶段。 模型创作能力持续深化,画面 真实感 显著增强,在光影表现、表演理解与执行、镜头运动上都更接近真实拍摄,成片质感与叙事可信度大幅提升,为专业创作者与企业客户提供更高效、更可控的视频生产能力。
glm-5.3
GLM-5.3是智谱AI面向长程任务(Long Horizon Task)设计的新一代开源旗舰模型,支持1M无损超长上下文。具备卓越的编程与工程能力,可自主完成任务拆解、架构设计、前后端开发、联调测试到多端部署的完整链路,适用于复杂工程任务、长程交互、代码生成、企业应用等场景。
qwen-image-3.0
指令理解清晰:支持最大 4.5k token 输入,复杂图文指令一次生成到位。 文字渲染稳定:10px 小字、12 国语言、20+ 字体清晰可辨,信息图和界面直接可用。 批量产出趁手:海报、网页、界面等日常任务可批量生成,成本更优,适合持续创作。 Qwen-Image-3.0 Standard 不只在追求生成效果,更在追求日常创作里的顺手与省心——让图像生成成为可持续的内容生产力。
qwen3.7-flash
Qwen3.7系列中高性价比Plus模型,在强大文本能力的基础上全面升级了视觉-语言能力,同时保持了在编码、工具使用和生产力工作流方面的完整智能体能力。其核心特色为多模态交互混合智能体能力,能够感知真实世界场景、读取屏幕并操作 GUI、基于视觉参考生成代码、端到端导航移动应用。
MiniMax-M2.7-highspeed
M2.7 在真实的软件工程中有优异的表现,包括端到端的完整项目交付,分析日志排查 Bug、代码安全,机器学习等。 在专业办公领域,我们提升了模型在各领域的专业知识和任务交付能力,在 GDPval-AA 的ELO得分是1495,为开源最高。M2.7 对 Office 三件套 Excel/PPT/Word 的复杂编辑能力显著提升,能更好地完成多轮修改和高保真的编辑。 M2.7具备与复杂环境交互的能力,M2.7 在 40 个复杂 skills (> 2000 Token) 的 case 上,仍能保持 97% 的 skills 遵循率。在OpenClaw的使用中,M2.7相比于M2.5也有了显著的提升,在MMClaw的评测中接近最新的Sonnet 4.6。 M2.7具备优秀的身份保持能力和情商,除了生产力使用外,给互动娱乐场景的创新也准备了空间。
MiniMax-M2.7
M2.7 在真实的软件工程中有优异的表现,包括端到端的完整项目交付,分析日志排查 Bug、代码安全,机器学习等。 在专业办公领域,我们提升了模型在各领域的专业知识和任务交付能力,在 GDPval-AA 的ELO得分是1495,为开源最高。M2.7 对 Office 三件套 Excel/PPT/Word 的复杂编辑能力显著提升,能更好地完成多轮修改和高保真的编辑。 M2.7具备与复杂环境交互的能力,M2.7 在 40 个复杂 skills (> 2000 Token) 的 case 上,仍能保持 97% 的 skills 遵循率。在OpenClaw的使用中,M2.7相比于M2.5也有了显著的提升,在MMClaw的评测中接近最新的Sonnet 4.6。 M2.7具备优秀的身份保持能力和情商,除了生产力使用外,给互动娱乐场景的创新也准备了空间。
MiniMax-M2.5-highspeed
MiniMax-M2.5是MiniMax推出的旗舰级开源大模型,经过数十万个真实复杂环境中的大规模强化学习训练,M2.5 在编程、工具调用和搜索、办公等生产力场景都达到或者刷新了行业的 SOTA。
kimi-k2.7-code-highspeed
Kimi K2.7 Code 高速版(kimi-k2.7-code-highspeed),与 Kimi K2.7 Code 是同一个模型,但输出速度约为普通版的 5-6 倍,常规编程场景下(取输入长度中位数)输出速度约 180 Token/s,短上下文场景可达 260 Token/s ,支持 256K 上下文窗口,带来更极致的编程体验。
没有找到匹配的模型
试试更换搜索关键词或筛选条件