限时开通年费会员,享30%折扣并且获得 GPT Image、MiniMax H3 等模型无限使用权益
新上线 AI Chat · 每天赠送免费试用次数
立即升级
Pixmind
API Platform

模型目录

模型随便选, 接入只写一次。

搜索 PixMind 已接入和规划接入的模型线路,对比能力与计费维度,然后把稳定模型 ID 复制到你的业务代码中。

图片、视频与 LLM 线路均已上线;仍在规划中的单个模型会在卡片上明确标记。
76条模型线路
19家模型供应商
43条可用线路

共 76 个结果

Google可用

Nano Banana Pro

擅长多语言可读文字、结构化视觉设计、多参考图融合和精确自然语言编辑。

文生图图片编辑多参考图+1
nano-banana-pro

API 建议价

$0.13/

比官方低 19%

OpenAI可用

GPT Image 2

适合海报、商品图、信息图和多轮设计迭代,生成与编辑控制能力强。

文生图图片编辑多参考图+1
gpt-image-2

API 建议价

$0.050/

比官方低 17%

Pixmind规划中

Pixmind

PixMind 免费图像生成线路,适合日常快速的文生图创作。

文生图
z-image

即将接入

价格待发布

Google规划中

Nano Banana Pro Eco

Nano Banana Pro 的经济版线路,支持文生图、图像编辑与参考图。

文生图图片编辑多参考图+1
nano-banana-pro-lite

即将接入

价格待发布

Google规划中

Nano Banana

初代 Nano Banana 图像生成线路,适用于多样化的文生图与编辑。

文生图图片编辑多参考图
nano-banana

即将接入

价格待发布

Midjourney规划中

Midjourney Niji 7

Midjourney 面向动漫与插画的模型,擅长风格化角色与鲜艳作品。

文生图图片编辑多参考图
mj-niji7

即将接入

价格待发布

Midjourney规划中

Midjourney V8.2

Midjourney V8.2,美学更精致,提示词贴合度更高,艺术风格更丰富。

文生图图片编辑多参考图
mj-v8.2

即将接入

价格待发布

Midjourney规划中

Midjourney V8.1

Midjourney V8.1,画质与一致性提升,适合精致的创意输出。

文生图图片编辑多参考图
mj-v8.1

即将接入

价格待发布

ByteDance规划中

Seedream 5.0

字节 Seedream 5.0 商业级图像生成,构图与细节表现出色。

文生图图片编辑多参考图+1
seedream-5.0

即将接入

价格待发布

ByteDance规划中

Seedream 4.5

Seedream 4.5 均衡型图像生成,画质稳定,适合日常创意。

文生图图片编辑多参考图+1
seedream-4.5

即将接入

价格待发布

ByteDance规划中

Seedream 4.0

Seedream 4.0 图像生成,支持文生图与编辑,面向生产级视觉。

文生图图片编辑多参考图+1
seedream-4.0

即将接入

价格待发布

OpenAI规划中

GPT Image 1.5

GPT Image 1.5 高控制度生成与编辑,适合设计密集型视觉。

文生图图片编辑多参考图
gpt-image-1.5

即将接入

价格待发布

OpenAI规划中

GPT Image 4o

GPT Image 4o 多用途图像生成,提示词遵循精准,编辑能力强。

文生图图片编辑多参考图
gpt-image-4o

即将接入

价格待发布

OpenAI规划中

GPT Image 2 Eco

GPT Image 2 经济版,适合规模化、成本敏感的生成与编辑。

文生图图片编辑多参考图+1
gpt-image-2-eco

即将接入

价格待发布

Alibaba规划中

Wan 2.6 Image

阿里 Wan 2.6 图像生成与编辑,支持多语言创意工作流。

文生图图片编辑多参考图
wan2.6-image

即将接入

价格待发布

Alibaba规划中

Wan 2.7 Image Pro

Wan 2.7 Image Pro,阿里更高阶线路,画面更锐利,适合生产级视觉。

文生图图片编辑多参考图+1
wan2.7-image-pro

即将接入

价格待发布

Alibaba规划中

Qwen Image 2.0 Pro

Qwen Image 2.0 Pro 文生图,文字清晰可读,细节丰富。

文生图
qwen-image-2.0-pro

即将接入

价格待发布

Grok AI规划中

Grok Imagine 1.5

Grok Imagine 1.5 图像生成,风格大胆、富有表现力。

文生图图片编辑多参考图
grok-imagine-1.5

即将接入

价格待发布

Recraft规划中

Recraft V4 Vector

Recraft V4 矢量图生成,输出干净、可缩放、适合印刷的设计稿。

文生图SVG 矢量输出
recraftv4_vector

即将接入

价格待发布

Recraft规划中

Recraft V4 Pro Vector

Recraft V4 Pro 矢量图生成,专业级品质,面向高质量设计。

文生图SVG 矢量输出
recraftv4_pro_vector

即将接入

价格待发布

Recraft规划中

Recraft Image to Vector

Recraft 图转矢量,将位图转换为可编辑的矢量图形。

图片编辑SVG 矢量输出
recraft-vectorize

即将接入

价格待发布

Google可用

Veo 3.1

电影感视频生成,支持图片引导、镜头控制、首尾帧以及原生音频。

文生视频图生视频原生音频+1
veo-3.1

API 建议价

$0.36/

比官方低 20%

MiniMax可用

MiniMax H3

原生 2K 音画同步视频生成,支持文字、图片、首尾帧与多模态参考输入。

文生视频图生视频原生音频+2
minimax-h3

API 建议价

$0.090/
ByteDance可用

Seedance 2.5

原生 30 秒单段视频,支持最多 50 个全模态参考、4K 输出与区域级局部编辑。

文生视频图生视频多参考图+2
seedance-2.5

API 建议价

$0.072/

比官方低 20%

Kuaishou可用

Kling V3

适合高保真图片动画,以及面向生产镜头的相机和主体动作控制。

文生视频图生视频多参考图+1
kling-v3-motion-control

API 建议价

$0.16/

比官方低 20%

Alibaba可用

Wan 2.7 Video

一条线路覆盖文生视频、图生视频、多参考以及首尾帧工作流。

文生视频图生视频多参考图+1
wan2.7-video

API 建议价

$0.12/

比官方低 20%

Alibaba可用

Wan 3.0 Video

Wan 3.0 视频生成,支持多模态参考、同步音频、2 至 30 秒片段以及最高 1080p 输出。

文生视频图生视频多参考图+2
wan3.0-video

API 建议价

$0.060/

比官方低 14%

OpenAI可用

Sora 2 Pro

适合更长的创意镜头,支持图片引导、丰富细节与音频输出。

文生视频图生视频原生音频+1
sora-2-pro

API 建议价

$0.048/

比官方低 20%

PixVerse可用

PixVerse V5

快速完成文生视频、图片动画、转场、特效与声音方向的创意验证。

文生视频图生视频首尾帧+1
pixverse-v5

API 建议价

$0.067/

比官方低 20%

ByteDance规划中

Seedance 2.0 Fast

Seedance 2.0 Fast,更快的 Seedance 线路,视频出片更快。

文生视频图生视频
seedance-2.0-fast

即将接入

价格待发布

ByteDance规划中

Seedance 2.0 Mini

Seedance 2.0 Mini,轻量版,高效生成短视频。

文生视频图生视频
seedance-2-0-mini

即将接入

价格待发布

OpenAI规划中

Sora 2

OpenAI Sora 2 视频生成,支持文生视频与图生视频的创意镜头。

文生视频图生视频
sora-2

即将接入

价格待发布

OpenAI规划中

Sora 2 Eco

Sora 2 经济版,成本更优的视频生成方案。

文生视频图生视频
sora-2-eco

即将接入

价格待发布

Google规划中

Veo 3

Google Veo 3 电影级视频生成,支持图像引导与音频。

文生视频图生视频
veo-3

即将接入

价格待发布

Google规划中

Veo 3.0 Fast

Veo 3.0 Fast,更快的 Veo 线路,适合快速迭代。

文生视频图生视频
veo-3.0-fast

即将接入

价格待发布

Google规划中

Veo 3.1 Eco

Veo 3.1 经济版,在画质与成本间取得平衡。

文生视频图生视频
veo-3.1-eco

即将接入

价格待发布

Google规划中

Veo 3.1 Fast Eco

Veo 3.1 Fast Eco,最省成本的 Veo 线路,快速且经济。

文生视频图生视频
veo-3.1-fast-eco

即将接入

价格待发布

PixVerse规划中

PixVerse V6

PixVerse V6 视频生成,支持文生视频、图像动画与特效。

文生视频图生视频
pixverse-v6

即将接入

价格待发布

Alibaba规划中

Wan 2.6 I2V

阿里 Wan 2.6 图生视频,让静态图像动起来。

图生视频
wan2.6-i2v

即将接入

价格待发布

Alibaba规划中

Wan 2.6 T2V

阿里 Wan 2.6 文生视频,将提示词转化为动态画面。

文生视频
wan2.6-t2v

即将接入

价格待发布

Alibaba规划中

Wan 2.6 I2V Flash

Wan 2.6 I2V Flash,快速图生视频变体,动画出片更快。

图生视频
wan2.6-i2v-flash

即将接入

价格待发布

Anthropic可用

Claude Fable 5

Anthropic Mythos 级线路,面向自主知识工作、长文本推理与编程。适合需要在长程任务中保持上下文、理解视觉输入并协调工具后给出简洁结果的 Agent。

文本视觉理解深度推理+3
claude-fable-5
输入$8.07/百万 Token
输出$40.33/百万 Token
Anthropic可用

Claude Opus 5

Anthropic 旗舰线路,适合高难推理、端到端软件工程、视觉分析与自主工具调用。更适合结果质量和任务持续性优先于最低成本的关键工作流。

文本视觉理解深度推理+3
claude-opus-5
输入$4.04/百万 Token
输出$20.17/百万 Token
Anthropic可用

Claude Sonnet 5

面向生产编程、Agent、专业写作和视觉推理的均衡 Claude 线路。当任务需要可靠的多步执行,同时希望控制在低于 Opus 的成本时,它是更实用的默认选择。

文本视觉理解深度推理+3
claude-sonnet-5
输入$1.62/百万 Token
输出$8.07/百万 Token
Anthropic可用

Claude Opus 4.8

适合复杂推理、编程、视觉和工具执行的高能力 Opus 线路。可用于需要谨慎规划、仓库级上下文以及跨多步骤保持决策一致性的长程任务。

文本视觉理解深度推理+3
claude-opus-4-8
输入$4.04/百万 Token
输出$20.17/百万 Token
Anthropic可用

Claude Opus 4.8 CC

专注编程与工具工作流的 Claude Opus 4.8 成本优化版本。适合希望保留 Opus 级任务处理能力,同时降低重复工程调用起步成本的场景。

文本深度推理工具调用+2
claude-opus-4-8-cc
输入$2.56/百万 Token
输出$12.77/百万 Token
Google规划中

Gemini Pro

规划中的多模态线路,覆盖文本、视觉、推理、流式返回和工具使用。

文本视觉理解图片输入+4
google/gemini-pro

即将接入

价格待发布

DeepSeek规划中

DeepSeek Reasoner

规划中的推理型线路,面向技术分析、编程和流式响应。

文本深度推理编程+1
deepseek/deepseek-reasoner

即将接入

价格待发布

DeepSeek可用

DeepSeek V4 Pro

DeepSeek V4 高能力纯文本线路,适合复杂推理、软件架构、细致代码审查和长文档分析,提供 100 万 Token 上下文。

文本深度推理编程+1
deepseek-v4-pro
输入$1.12/百万 Token
输出$3.36/百万 Token
DeepSeek可用

DeepSeek V4 Flash

DeepSeek V4 高性价比纯文本线路,适合高吞吐抽取、分类、改写、摘要和轻量编程,提供 100 万 Token 上下文。

文本深度推理编程+1
deepseek-v4-flash
输入$0.38/百万 Token
输出$1.12/百万 Token
智谱 AI可用

GLM-5.3

智谱 AI 面向复杂软件工程与长程 Agent 的大型推理线路。长上下文设计适合仓库级分析、多步工具调用,以及必须保持前后决策一致的流式技术任务。

文本深度推理工具调用+2
glm-5.3
输入$1.48/百万 Token
输出$5.17/百万 Token
智谱 AI可用

GLM-5.3-Flash

面向聚焦编程、视觉推理和 Agent 子任务的高性价比多模态 GLM 线路。适合需要长上下文和工具调用,但不希望承担完整 GLM-5.3 起步成本的高频工作流。

文本视觉理解图片输入+2
glm-5.3-flash
输入$0.15/百万 Token
输出$0.52/百万 Token
OpenAI可用

GPT-5.6 Sol

GPT-5.6 系列旗舰线路,面向复杂推理、编程、视觉和 Agent 执行。适合命令行、多步工程与工具工作流等质量优先、能够接受更高 Token 成本的任务。

文本视觉理解深度推理+2
gpt-5.6-sol
输入$3.90/百万 Token
输出$23.39/百万 Token
OpenAI可用

GPT-5.6 Terra

GPT-5.6 系列均衡档,覆盖日常编程、推理、视觉输入与工具调用。当生产任务需要可靠 Agent 能力,又不必每次使用旗舰 Sol 时,可优先选择 Terra。

文本视觉理解深度推理+2
gpt-5.6-terra
输入$1.56/百万 Token
输出$9.36/百万 Token
OpenAI可用

GPT-5.6 Luna

GPT-5.6 轻量档,面向高频、延迟敏感的文本任务。适合聊天、抽取、分类和简单流式工作流,重点是成本效率而不是深度多模态推理。

文本流式返回
gpt-5.6-luna
输入$0.16/百万 Token
输出$0.94/百万 Token
Google可用

Gemini 3.1 Pro Preview

Google 面向复杂推理、软件工程和多模态分析的前沿预览线路。通过 PixMind 接收文本、图片与视频,适合需要 Pro 级推理深度和工具调用的高难工作流。

文本视觉理解图片输入+4
gemini-3.1-pro-preview
输入$2.02/百万 Token
输出$12.10/百万 Token
Google可用

Gemini 3.5 Flash

在 Flash 成本与速度档位中提供较强编程、推理和多模态理解能力。适合响应式 Agent 与并行处理,在吞吐、视觉分析能力和成本之间取得平衡。

文本视觉理解图片输入+4
gemini-3.5-flash
输入$1.43/百万 Token
输出$8.65/百万 Token
Google可用

Gemini 3.6 Flash

面向编程、Agent 工作流以及网页或应用输出的响应式多模态线路。适合需要增强推理与视觉上下文,同时希望保持 Flash 级效率的生产任务。

文本视觉理解图片输入+4
gemini-3.6-flash
输入$1.01/百万 Token
输出$5.19/百万 Token
Google可用

Gemini 3.8 Flash

Google 当前能力最强的 Flash 级线路,面向长程软件工程、自主 Agent 和复杂多步工作流。通过 PixMind 可组合文本、图片、音频、视频与 PDF 输入,并使用推理、工具、编程和流式文本输出。

文本视觉理解图片输入+7
gemini-3.8-flash
输入$1.01/百万 Token
输出$5.19/百万 Token
Google可用

Gemini 3.7 Flash

Google 面向快速 Agent 工作流、编程和可靠多步推理的多模态 Flash 线路。适合把文本、图片或视频上下文与流式输出结合起来的响应式产品。

文本视觉理解图片输入+2
gemini-3.7-flash
输入$1.01/百万 Token
输出$5.19/百万 Token
Google可用

Gemini 3.5 Flash-Lite

Google 面向聚焦、可重复子任务的低成本 Flash 档位。适合高频聊天、抽取、分类和轻量 Agent,重点是更小的价格占用而不是最高推理深度。

文本视觉理解图片输入+2
gemini-3.5-flash-lite
输入$0.41/百万 Token
输出$3.37/百万 Token

API 独立定价

API 调用价格与 PixMind 站内创作价格分开

站内积分包含创作界面、工作流工具、存储和产品服务;API 使用面向程序化批量调用的独立按量账本。首发建议价约比同配置站内入门价格低 20%,最终请求价格仍会随分辨率、时长、音频、质量和输出数量变化。