{"auto_groups":["default"],"data":[{"model_name":"claude-sonnet-4-5-20250929","description":"Claude Sonnet 4.5 是 Anthropic 推出的新一代高性能模型，在速度、成本与智能之间取得了极佳平衡，适用于高并发任务处理及实时交互场景。","icon":"Claude.Color","tags":" 文本生成,国外闭源","vendor_id":3,"quota_type":0,"model_ratio":1.5,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"create_cache_ratio":1.25,"enable_groups":["default","svip"],"supported_endpoint_types":["anthropic","openai"],"pricing_version":"5a90f2b86c08bd983a9a2e6d66c255f4eaef9c4bc934386d2b6ae84ef0ff1f1f"},{"model_name":"doubao-seedance-2-0-260128","description":"豆包大模型团队推出的新一代专业级多模态创作视频模型 Seedance 2.0，支持图像、视频、音频等多模态作为参考输入生成视频，还具备视频编辑、延长等能力，能高精度还原各类细节并稳定角色特征，具备极致拟真的视听稳定性，深度适配商业广告、影视制作与社交媒体营销等各大核心场景","tags":"国内闭源, 参考图片/视频/音频生视频,编辑视频,视觉模型","vendor_id":5,"quota_type":0,"model_ratio":5.543475,"model_price":0,"owner_by":"","completion_ratio":1,"enable_groups":["default"],"supported_endpoint_types":["videos","task"]},{"model_name":"gpt-4o-transcribe","vendor_id":4,"quota_type":0,"model_ratio":1.25,"model_price":0,"owner_by":"","completion_ratio":4,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-5-mini-2025-08-07","description":"OpenAI 于 2025 年 8 月 7 日发布的 GPT-5 系列轻量级版本，在保持 GPT-5 核心能力的同时大幅优化速度与成本。128K 上下文窗口，知识截止至 2025 年 5 月，支持文本与图像多模态输入。采用统一系统架构，内置轻量化推理模块，可处理中等复杂度的编程、写作、分析任务。适用于高并发对话、内容生成、代码补全、图像理解、文本分类等对成本敏感的生产场景。","tags":" 文本生成, 推理, 多模态,代码,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":0.125,"model_price":0,"owner_by":"","completion_ratio":8,"cache_ratio":0.1,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-6-astra","tags":"国外模型","vendor_id":4,"quota_type":0,"model_ratio":5,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"create_cache_ratio":1.25,"prompt_length_pricing":{"base":{"input_ratio":5,"completion_ratio":5,"cache_ratio":0.1,"cache_creation_ratio":1.25},"tiers":[{"threshold_tokens":272000,"input_ratio":10,"completion_ratio":3.75,"cache_ratio":0.1,"cache_creation_ratio":1.25}]},"enable_groups":["default","svip"],"supported_endpoint_types":["openai"]},{"model_name":"grok-4-1-fast-non-reasoning","description":"Grok-4-1-Fast-Non-Reasoning 是 xAI 公司推出的高性能 AI 模型，专为即时响应和低延迟交互而设计。作为 Grok 4.1 系列的“非推理”版本，它在保持顶尖智能水平的同时，无需进行复杂的深度思考，即可提供快速、精准的回答，非常适合实时对话和快速任务处理。","tags":"国外闭源,文本生成","vendor_id":8,"quota_type":0,"model_ratio":0.1,"model_price":0,"owner_by":"","completion_ratio":2.5,"enable_groups":["default"],"supported_endpoint_types":["openai","openai-response"]},{"model_name":"deepseek-ocr","vendor_id":1,"quota_type":0,"model_ratio":0.28,"model_price":0,"owner_by":"","completion_ratio":3,"cache_ratio":0.25,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gemini-3-pro-preview-11-2025","description":"Gemini 3 Pro Preview (11-2025) 是 Google 于 2025 年 11 月推出的下一代旗舰级 AI 模型的预览版本。作为 Gemini 系列的最新迭代，它在推理能力、代码生成、多模态理解和长上下文处理方面实现了全面升级。该模型支持高达 200 万 Token 的超长上下文窗口，具备更强大的\"思考\"机制，适合需要极致智能和复杂任务处理能力的企业级应用场景。","tags":" 多模态,国外闭源","vendor_id":6,"quota_type":0,"model_ratio":1,"model_price":0,"owner_by":"","completion_ratio":6,"enable_groups":["default"],"supported_endpoint_types":["gemini","openai"]},{"model_name":"gpt-4.1","description":"OpenAI 于 2025 年 4 月发布的 GPT-4.1 系列旗舰模型，专为开发者设计，仅通过 API 提供 。拥有 100 万 token 的超大上下文窗口，支持多模态输入（文本与图像），知识截止至 2024 年 6 月 。在编码能力上显著提升，SWE-bench Verified 得分 54.6%，较 GPT-4o 提升 21.4 个百分点 ；指令遵循能力在 MultiChallenge 基准上得分 38.3%，较 GPT-4o 提升 10.5 个百分点 ；输出 token 限制提升至 32,768 。支持函数调用、结构化输出、并行工具调用等 API 能力 。定价为 $2/百万输入 token、$8/百万输出 token，较 GPT-4o 便宜 26% 。","tags":" 文本生成, 多模态,代码,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":1,"model_price":0,"owner_by":"","completion_ratio":4,"cache_ratio":0.25,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-4o-mini","description":"penAI 于 2024 年 7 月发布的轻量级多模态模型，128K 上下文窗口，支持文本与图像输入，知识截止至 2023 年 10 月。在保持 GPT-4o 核心能力的同时大幅优化速度与成本，MMLU 基准得分 82%，性能超越 GPT-3.5 Turbo。支持函数调用、JSON 模式、结构化输出等 API 能力。","tags":" 文本生成, 多模态,代码,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":0.075,"model_price":0,"owner_by":"","completion_ratio":4,"cache_ratio":0.5,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-4.1-2025-04-14","description":"OpenAI GPT-4.1 系列的 2025 年 4 月 14 日稳定版本，100 万 token 超大上下文窗口，支持多模态输入（文本与图像），知识截止至 2024 年 6 月。编码能力显著提升，SWE-bench Verified 得分 54.6%，指令遵循能力在 MultiChallenge 基准上得分 38.3%，输出 token 限制 32,768。支持函数调用、结构化输出、并行工具调用等 API 能力。定价 $2/百万输入 token、$8/百万输出 token。","tags":" 文本生成, 多模态,代码,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":1,"model_price":0,"owner_by":"","completion_ratio":4,"cache_ratio":0.25,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-4.1-nano-2025-04-14","description":"gpt-4.1-nano-2025-04-14：OpenAI GPT-4.1 系列中速度最快、成本最低的轻量级模型，2025 年 4 月 14 日发布，100 万 token 超大上下文窗口，支持多模态输入（文本与图像），知识截止至 2024 年 6 月。专为低延迟、高吞吐量场景优化，定价 $0.10/百万输入 token、$0.40/百万输出 token，适用于轻量级对话、文本分类、内容过滤、数据清洗等对成本极度敏感的任务。支持函数调用、结构化输出等 API 能力。","tags":" 文本生成, 多模态,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":0.05,"model_price":0,"owner_by":"","completion_ratio":4,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"deepseek-flash","description":"DeepSeek V4.1 Flash 为 552B 参数的 MoE 模型，采用了全新的 Causal-Encoder-Decoder 结构，输入和输出不对称，输入激活只有 8B，输出激活 16B，成本显著低于已知的同尺寸模型。同时，V4.1 Flash 还采用了新的预训练方式、经过了更大规模的强化学习后训练，在基准测试中，成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型的智能水平。","tags":"国内开源","vendor_id":1,"quota_type":0,"model_ratio":0.147275405,"model_price":0,"owner_by":"","completion_ratio":4,"cache_ratio":0.019999999321,"enable_groups":["default","svip"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-4o-2024-11-20","description":"OpenAI 于 2024 年 11 月 20 日发布的 GPT-4o 稳定更新版本，128K 上下文窗口，支持多模态输入（文本与图像），知识截止至 2024 年 6 月。该版本在指令遵循、结构化输出、函数调用等方面进一步优化，提升了模型稳定性与输出一致性。适用于实时对话、图像理解、代码生成、复杂推理及需要高可靠性输出的生产环境场景。定价 $2.50/百万输入 token、$10/百万输出 token。","tags":" 文本生成, 多模态,代码,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":1.25,"model_price":0,"owner_by":"","completion_ratio":4,"cache_ratio":0.5,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-5.2","description":"OpenAI 于 2025 年 12 月 11 日发布的 GPT-5 系列重大升级版本，旨在应对谷歌 Gemini 3 的竞争压力。提供 Instant、Thinking 和 Pro 三种性能层级，知识截止日期更新至 2025 年 8 月 31 日。400K 超大上下文窗口，128K 最大输出 token。在 OpenAI 自研的 GDPval 基准测试中，Thinking 版本在 70.9% 的知识工作任务中表现优于或持平顶尖行业专业人士，较 GPT-5.1 的 38.8% 实现显著提升。编码能力方面，SWE-bench Verified 得分 80%，SWE-Bench Pro 达 55.6%；ARC-AGI-2 得分 52.9%。幻觉率较 GPT-5.1 降低约 30%，但仍以 8.4% 的幻觉率落后于 DeepSeek V3.2 的 6.3%。适用于电子表格制作、演示文稿构建、代码编写、图像理解、长文本处理、复杂多步骤项目等专业工作场景。","tags":" 文本生成,代码,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":0.875,"model_price":0,"owner_by":"","completion_ratio":8,"cache_ratio":0.1,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"claude-3-opus-20240229","description":"Claude 3 Opus 是由 Anthropic 提供的高性能人工智能模型。","icon":"Claude.Color","tags":"文本生成,国外闭源","vendor_id":3,"quota_type":0,"model_ratio":7.5,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"create_cache_ratio":1.25,"enable_groups":["default"],"supported_endpoint_types":["openai","anthropic"]},{"model_name":"Qwen3-32B","description":"Qwen3-32B 是阿里巴巴通义千问推出的高性能开源模型，以其卓越的性价比著称。它支持128K超长上下文，在编程、数学推理及多语言场景下表现出色，是企业级私有化部署和开发者应用的高性价比首选。","icon":"Qwen.Color","tags":"国内开源, 文本生成,代码","vendor_id":2,"quota_type":0,"model_ratio":0.0724635,"model_price":0,"owner_by":"","completion_ratio":4.000013800051,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"deepseek-v4-pro","description":"DeepSeek 新一代旗舰级 MoE 大模型，总参1.6T、激活 49B，原生支持百万级超长上下文。依托海量高质量训练数据，具备顶尖数学逻辑、复杂推理、专业代码与长文本深度解析能力，适配高阶科研、复杂办公、深度智能代理等高难度场景。","tags":"代码,国内开源,代码","vendor_id":1,"quota_type":0,"model_ratio":0.6627393,"model_price":0,"owner_by":"","completion_ratio":3.000000075444,"cache_ratio":0.033333333333,"enable_groups":["svip","default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-5.1-chat-latest","description":"OpenAI于2025年11月发布的GPT-5.1系列对话优化版本，是ChatGPT产品中“GPT-5.1 Instant”对应的API模型名称。128K上下文窗口，最大输出约16K tokens，知识截止至2024年9月30日。核心特性包括：自适应推理能力，简单查询快速响应，复杂问题自动投入更多思考时间；默认语气更温暖、更具对话性，改进指令遵循能力；支持八种沟通风格预设（专业、友好、坦率、古怪、高效、书呆子、愤世嫉俗等）；支持函数调用、结构化输出、多模态输入（文本与图像）。注意：该模型内置ChatGPT系统提示（语气调教、安全策略等），不可移除，适合面向用户的聊天入口，但不推荐用于Agent、RAG或严格结构化输出任务。","tags":" 文本生成, 多模态,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":0.625,"model_price":0,"owner_by":"","completion_ratio":8,"cache_ratio":0.1,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"happyhorse-1.0-r2v","description":"HappyHorse-参考生视频模型支持传入多张参考图像，通过文本提示词描述场景，将图像中的主体角色融合生成一段流畅的视频。","tags":"参考生视频","vendor_id":2,"quota_type":0,"model_ratio":0.5,"model_price":0,"owner_by":"","completion_ratio":1,"enable_groups":["default"],"supported_endpoint_types":["video-generation"]},{"model_name":"Qwen3-Reranker-4B","description":"Qwen3-Reranker-4B 是阿里巴巴通义千问推出的专用重排序模型。它采用交叉编码器（Cross-Encoder）架构，能够深度理解查询与文档间的语义关联，在专利检索、长文档处理等复杂场景中表现卓越，显著提升检索结果的精准度。","icon":"Qwen.Color","tags":"国内开源, 重排序","vendor_id":2,"quota_type":0,"model_ratio":0.0101445,"model_price":0,"owner_by":"","completion_ratio":1,"enable_groups":["default"],"supported_endpoint_types":["path","method"]},{"model_name":"gpt-4o-mini-2024-07-18","description":"OpenAI 于 2024 年 7 月 18 日发布的轻量级多模态模型稳定版本，128K 上下文窗口，支持文本与图像输入，知识截止至 2023 年 10 月。MMLU 基准得分 82%，性能超越 GPT-3.5 Turbo，支持函数调用、JSON 模式、结构化输出等 API 能力。","tags":" 文本生成, 多模态,代码,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":0.075,"model_price":0,"owner_by":"","completion_ratio":4,"cache_ratio":0.5,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"kling-v3","description":"Kling 3.0 代表了 AI 视频技术的突破。作为首个统一多模态模型，Kling 3.0 在单一架构内生成视频、音频和图像。借助 Kling 3.0 Motion 控制、原生 4K 输出和物理感知模拟，创建媲美传统制作的专业级内容。","tags":"文生视频","vendor_id":12,"quota_type":0,"model_ratio":5.79668,"model_price":0,"owner_by":"","completion_ratio":1,"enable_groups":["default"],"supported_endpoint_types":["video-generation"]},{"model_name":"o3-pro","description":"OpenAI o3 系列的旗舰推理版本，面向需要最高级别推理能力的专业场景。采用深度私有思维链机制，在回答前进行长时间内部思考与自我验证，在数学、编程、科学等复杂推理任务上达到顶尖水平。支持 200K 上下文窗口，支持函数调用与结构化输出。适用于复杂数学证明、高级编程竞赛、博士级科学研究、战略决策、法律分析等需要极致推理深度的专业场景。","tags":" 文本生成,代码,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":10,"model_price":0,"owner_by":"","completion_ratio":4,"enable_groups":["default"],"supported_endpoint_types":["path","method"]},{"model_name":"claude-sonnet-5","description":"Claude Sonnet 5 是 Anthropic 发布的一款高性价比 Sonnet 级模型，面向浏览器操作、编码、规划和知识工作等代理式任务设计，适合日常复杂工作的自动化推进","tags":"国外闭源,代码","vendor_id":3,"quota_type":0,"model_ratio":1,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"create_cache_ratio":1.25,"enable_groups":["default","svip"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"MiniMax-M3","description":"MiniMax M3 是国产开源旗舰大模型，集前沿编码能力、百万级上下文处理和原生多模态能力于一体，可作为智能编程与复杂任务的 AI 工程助手。","tags":"国内开源,文本生成","vendor_id":11,"quota_type":0,"model_ratio":0.30432575,"model_price":0,"owner_by":"","completion_ratio":4.065096042809,"cache_ratio":0.203254801804,"enable_groups":["svip","default"],"supported_endpoint_types":["openai"]},{"model_name":"claude-opus-4-1-20250805","description":"Claude Opus 4.1 是由 Anthropic 提供的高级人工智能模型，专为处理高度复杂的任务、深度推理及高级编码而设计。","icon":"Claude.Color","tags":" 文本生成,国外闭源","vendor_id":3,"quota_type":0,"model_ratio":7.5,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"create_cache_ratio":1.25,"enable_groups":["default"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"gemini-3-pro-preview-thinking","description":"Gemini 3 Pro Preview (11-2025) 是 Google 于 2025 年 11 月推出的下一代旗舰级 AI 模型的预览版本。作为 Gemini 系列的最新迭代，它在推理能力、代码生成、多模态理解和长上下文处理方面实现了全面升级。该模型支持高达 200 万 Token 的超长上下文窗口，具备更强大的\"思考\"机制，适合需要极致智能和复杂任务处理能力的企业级应用场景。","tags":" 多模态,国外闭源","vendor_id":6,"quota_type":0,"model_ratio":1,"model_price":0,"owner_by":"","completion_ratio":6,"enable_groups":["default"],"supported_endpoint_types":["gemini","openai"]},{"model_name":"gpt-5.3-codex-high","description":"OpenAI GPT-5.3 系列编程增强版本，是 Codex 生态中最强大的智能体编程模型。在标准版基础上引入更深度推理机制与优化资源分配策略，专为超大规模代码库重构、跨系统迁移、复杂架构设计等需要长时间深度思考的任务优化。核心特性包括：仓库级智能，支持百万行级代码理解与重构；多模态输入，可解析架构图、时序图、设计稿；长时任务保持与断点续传，支持持续运行复杂项目；自适应推理，根据任务复杂度动态分配计算资源。支持函数调用、结构化输出、异步执行等完整 API 能力。适用于企业级代码库重构、大型系统迁移、智能体自动化开发、复杂测试生成等专业场景。注意：该模型仅支持 OpenAI Responses API（/v1/responses 端点），不支持标准 Chat Completions API。","tags":" 文本生成, 多模态,代码,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":0.875,"model_price":0,"owner_by":"","completion_ratio":8,"cache_ratio":0.1,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"grok-2-1212","description":"Grok-2-1212 是 xAI 公司研发的 Grok-2 系列大语言模型的一个特定版本。该模型在聊天、编码、数学推理等核心能力上表现优异，支持多语言处理与实时数据引用，并提供 API 服务。\n标签","tags":" 文本生成,国外闭源,代码","vendor_id":8,"quota_type":0,"model_ratio":1,"model_price":0,"owner_by":"","completion_ratio":5,"enable_groups":["default"],"supported_endpoint_types":["openai","openai-response"]},{"model_name":"gemini-3.1-flash-image-preview","description":"Gemini 3 Pro Preview (11-2025) 是 Google 于 2025 年 11 月推出的下一代旗舰级 AI 模型的预览版本。作为 Gemini 系列的最新迭代，它在推理能力、代码生成、多模态理解和长上下文处理方面实现了全面升级。该模型支持高达 200 万 Token 的超长上下文窗口，具备更强大的\"思考\"机制，适合需要极致智能和复杂任务处理能力的企业级应用场景。","tags":" 多模态,国外闭源","vendor_id":6,"quota_type":1,"model_ratio":0,"model_price":0.045,"owner_by":"","completion_ratio":0,"enable_groups":["default"],"supported_endpoint_types":["gemini","openai"]},{"model_name":"gpt-4o-2024-08-06","description":"OpenAI 于 2024 年 8 月 6 日发布的 GPT-4o 稳定更新版本，128K 上下文窗口，支持多模态输入（文本与图像），知识截止至 2023 年 10 月。该版本重点优化了结构化输出（Structured Outputs）能力，支持原生 JSON Schema 遵循，确保输出格式严格可控，适合需要可靠数据格式的生产环境应用。支持函数调用、并行工具调用等 API 能力。定价 $2.50/百万输入 token、$10/百万输出 token。","tags":" 文本生成, 多模态,代码,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":1.25,"model_price":0,"owner_by":"","completion_ratio":4,"cache_ratio":0.5,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"happyhorse-1.0-i2v","description":"HappyHorse图生视频模型，以首帧图片为基础，支持通过文本描述进行引导，生成物理真实、运动流畅的视频。","tags":"图生视频","vendor_id":2,"quota_type":0,"model_ratio":0.5,"model_price":0,"owner_by":"","completion_ratio":1,"enable_groups":["default"],"supported_endpoint_types":["video-generation"]},{"model_name":"Qwen3-Embedding-0.6B","description":"Qwen3-Embedding-0.6B 是阿里巴巴通义千问推出的轻量级文本嵌入模型。它专为语义检索、文本聚类和RAG（检索增强生成）系统优化，支持100+种语言及代码，以极高的性价比和强大的多语言能力著称。","icon":"Qwen.Color","tags":"国内开源, 文本嵌入","vendor_id":2,"quota_type":0,"model_ratio":0.005072,"model_price":0,"owner_by":"","completion_ratio":1,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"doubao-seedream-4-0-250828","description":"豆包图像创作模型，原生 4K 直出，1.8 秒生成 2K，支持多图融合与组图生成。","tags":"国内闭源, 文生图, 图像编辑","vendor_id":5,"quota_type":1,"model_ratio":0,"model_price":0.028,"owner_by":"","completion_ratio":0,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-4-turbo-2024-04-09","description":"OpenAI GPT-4 Turbo 的 2024 年 4 月 9 日稳定版本，128K 上下文窗口，知识截止至 2023 年 12 月，支持函数调用、JSON 模式、并行工具调用、视觉输入（Vision）等多模态能力，适用于长文本处理、图像理解、复杂推理等高级任务。","tags":" 文本生成, 多模态,代码,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":5,"model_price":0,"owner_by":"","completion_ratio":3,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-5.3-codex-low","description":"OpenAI GPT-5.3 系列编程轻量版本，专为高频、低延迟的代码生成与辅助任务优化。在保持核心编程能力的同时大幅降低响应延迟，采用精简推理路径，适合快速代码补全、简单函数生成、代码解释、单元测试编写等日常编程场景。支持仓库级上下文理解，但推理深度较标准版有所精简以换取速度优势。支持多模态输入（文本与图像），可解析简单的 UI 截图与流程图。支持函数调用、结构化输出等 API 能力。适用于日常编码辅助、快速原型开发、代码审查、教学演示等对响应速度要求较高的场景。注意：该模型仅支持 OpenAI Responses API（/v1/responses 端点），不支持标准 Chat Completions API。","tags":" 文本生成, 多模态,代码,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":0.875,"model_price":0,"owner_by":"","completion_ratio":8,"cache_ratio":0.1,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"grok-3-reasoning","description":"Grok-3-Reasoning 是 xAI 公司专为复杂逻辑推理和科学计算打造的旗舰模型。它利用“测试时计算”技术深度拆解问题，在 AIME 数学竞赛和 GPQA 科学测试中表现卓越，擅长处理高难度数学、物理及代码生成任务。","tags":"数学,代码,国外闭源","vendor_id":8,"quota_type":0,"model_ratio":3,"model_price":0,"owner_by":"","completion_ratio":3,"enable_groups":["default"],"supported_endpoint_types":["openai","openai-response"]},{"model_name":"mureka-o2","description":"Mureka-O2 是由中国昆仑万维打造的一体化智能音乐模型，具有专业级效果，支持指定歌曲风格，为歌曲录制旋律动机，支持完整歌曲下载，并默认生成歌词。","tags":"国内闭源,音乐","vendor_id":13,"quota_type":1,"model_ratio":0,"model_price":0.4782262,"owner_by":"","completion_ratio":0,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"mureka-song-auto","description":"Mureka-Song-Auto是由中国昆仑万维打造的AI歌曲创作模型，支持指定歌曲风格，为歌曲录制旋律动机，支持完整歌曲下载，并默认生成歌词。","tags":"国内闭源,音乐","vendor_id":13,"quota_type":1,"model_ratio":0,"model_price":0.4782262,"owner_by":"","completion_ratio":0,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"claude-haiku-4-5-20251001","description":"Claude Haiku 4.5 是由 Anthropic 提供的人工智能模型，以极致的速度和效率著称，适用于需要快速响应的即时任务。","icon":"Claude.Color","tags":" 文本生成,国外闭源","vendor_id":3,"quota_type":0,"model_ratio":0.5,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"create_cache_ratio":1.25,"enable_groups":["svip","default"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"claude-opus-4-5-20251101","description":"Claude Opus 4.5 是 Anthropic 发布的新一代旗舰级通用模型，在编码、智能体协作及计算机操作方面表现卓越，支持 200K 上下文窗口及 MoonBit 语言原生支持。","icon":"Claude.Color","tags":" 文本生成,国外闭源,代码","vendor_id":3,"quota_type":0,"model_ratio":2.5,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"create_cache_ratio":1.25,"enable_groups":["default","svip"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"gemini-3-pro-image-preview","description":"Gemini 3 Pro Image Preview 是 Google 推出的专注于图像生成与多模态理解的预览版旗舰模型。它具备卓越的视觉生成能力，能够根据文本提示创作高质量图像，同时支持对图像内容的深度理解与分析。该模型集成了 Gemini 3 系列的强大推理能力，支持超长上下文，适合需要高质量视觉内容创作与跨模态交互的复杂应用场景。","tags":" 图像生成, 多模态,国外闭源,视觉模型","vendor_id":6,"quota_type":1,"model_ratio":0,"model_price":0.134,"owner_by":"","completion_ratio":0,"enable_groups":["default"],"supported_endpoint_types":["gemini","openai"]},{"model_name":"gpt-4.1-mini-2025-04-14","description":"OpenAI GPT-4.1 系列的小型化版本，2025 年 4 月 14 日发布，100 万 token 超大上下文窗口，支持多模态输入（文本与图像），知识截止至 2024 年 6 月。在保持高效推理能力的同时优化速度与成本，延迟较 GPT-4.1 降低 60%，定价 $0.40/百万输入 token、$1.60/百万输出 token，适用于中等复杂度对话、文本生成、代码补全等对成本敏感的场景。支持函数调用、结构化输出等 API 能力。","tags":" 文本生成, 多模态,代码,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":0.2,"model_price":0,"owner_by":"","completion_ratio":4,"cache_ratio":0.25,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-5-codex","description":"OpenAI 于 2025 年 9 月 15 日发布的编程专用模型，是 GPT-5 的 Agent 编码优化版本，专为 Codex 生态系统设计。采用真·动态思考能力，可根据任务复杂度实时调整计算时间（从数秒到长达 7 小时），简单任务响应提速 10 倍，复杂任务投入更多算力深度推理。400K 上下文窗口，支持多文件仓库级理解与跨文件依赖分析，知识截止至 2024 年 9 月 30 日。在 SWE-bench Verified 基准测试中得分 74.9%，重构任务成功率 51.3%（远超 GPT-5 的 33.9%），Aider Polyglot 通过率 88%。经 RL 训练于真实 PR 数据，支持代码审查、测试驱动开发、多步骤规划与工具调用。","tags":" 文本生成,代码,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":0.625,"model_price":0,"owner_by":"","completion_ratio":8,"cache_ratio":0.1,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-6-luna","tags":"国外模型","vendor_id":4,"quota_type":0,"model_ratio":0.05,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"create_cache_ratio":1.25,"prompt_length_pricing":{"base":{"input_ratio":0.05,"completion_ratio":5,"cache_ratio":0.1,"cache_creation_ratio":1.25},"tiers":[{"threshold_tokens":272000,"input_ratio":0.1,"completion_ratio":3.75,"cache_ratio":0.1,"cache_creation_ratio":1.25}]},"enable_groups":["default","svip"],"supported_endpoint_types":["openai"]},{"model_name":"kimi-k3","description":"Kimi K3 是 Kimi 迄今能力最强的旗舰模型，拥有 2.8 万亿参数，基于 KDA 混合线性注意力机制（Kimi Delta Attention）和注意力残差（Attention Residuals）技术构建，原生支持视觉理解，并拥有 100 万 token 上下文窗口。它是全球首个开源的 3 万亿级别模型，面向长程编程、知识工作和推理等前沿智能场景而设计","tags":"国内开源,代码","vendor_id":9,"quota_type":0,"model_ratio":1.47276,"model_price":0,"owner_by":"","completion_ratio":4.999979630082,"cache_ratio":0.099999321003,"enable_groups":["default","svip"],"supported_endpoint_types":["0"]},{"model_name":"text-embedding-3-large","description":"OpenAI 于 2024 年 1 月发布的第三代大型文本嵌入模型，具备 3,072 维向量输出能力，是 OpenAI 嵌入模型系列中性能最强的版本。支持多语言处理，在 MTEB 基准上表现优异，适用于语义搜索、聚类、分类、推荐系统、RAG 检索等场景。支持缩小嵌入维度（通过 dimensions 参数），开发者可在不牺牲性能的前提下按需裁剪向量维度以优化存储与计算成本。","tags":" 文本嵌入,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":0.065,"model_price":0,"owner_by":"","completion_ratio":1,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gemini-3.5-flash","description":"Google Gemini 3.5 是谷歌于 2026年5月19日 推出的新一代大模型系列。该系列将前沿的多模态理解与推理能力与高效行动力深度融合，旨在帮助开发者构建更具能力、更智能的自主 Agent（智能体）与自动化 编程工作流。","tags":"国外模型,多模态","vendor_id":6,"quota_type":0,"model_ratio":0.75,"model_price":0,"owner_by":"","completion_ratio":6,"enable_groups":["default"],"supported_endpoint_types":["gemini","openai"]},{"model_name":"gpt-4-1106-preview","description":"OpenAI GPT-4 Turbo 预览版，2023年11月6日发布，128K 上下文窗口，支持函数调用、JSON 模式，知识截止至 2023 年 4 月，性能与成本优化，适用于长文本处理与复杂推理任务。","tags":" 文本生成,代码,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":5,"model_price":0,"owner_by":"","completion_ratio":3,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"text-embedding-ada-002","description":"OpenAI 推出的第二代文本嵌入模型，具备 1,536 维向量输出能力，支持多语言处理，在语义搜索、聚类、分类、推荐系统、RAG 检索等场景中表现稳定。作为 OpenAI 嵌入模型系列中成本最低的选项之一，适用于对成本敏感的大规模文本向量化任务。","tags":" 文本嵌入,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":0.05,"model_price":0,"owner_by":"","completion_ratio":1,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"kling-v3-omni","description":"全球首个统一多模态 AI 视频引擎。 由 Omni One 架构驱动，Kling 3.0 提供物理精确生成、原生音频同步和导演级运镜控制，交付电影级成果。 Kling 3.0 结合 Omni One 架构与链式思维推理，实现电影级 AI 视频生成。 Kling 3.0 理解真实世界物理——重力、平衡、形变和惯性。 生成的视频中物体行为与现实完全一致。","tags":"文生视频,图生视频","vendor_id":12,"quota_type":0,"model_ratio":5.79668,"model_price":0,"owner_by":"","completion_ratio":1,"enable_groups":["default"],"supported_endpoint_types":["video-generation"]},{"model_name":"mureka-9","description":"Mureka-9 是由中国昆仑万维打造的一体化智能音乐模型，支持精准指令控制，专业级音质，支持指定歌曲风格，为歌曲录制旋律动机，支持完整歌曲下载，并默认生成歌词。","tags":"国内闭源,音乐","vendor_id":13,"quota_type":1,"model_ratio":0,"model_price":0.4782262,"owner_by":"","completion_ratio":0,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"claude-opus-4-6","description":"Claude Opus 4.6 是 Anthropic 发布的旗舰级人工智能模型，引入“AI代理团队”功能，支持百万级上下文窗口，在金融研究、复杂编码及办公自动化领域表现卓越。","icon":"Claude.Color","tags":" 文本生成,代码,国外闭源","vendor_id":3,"quota_type":0,"model_ratio":2.5,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"create_cache_ratio":1.25,"enable_groups":["default","svip"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"claude-opus-5-5","tags":"国外模型","vendor_id":3,"quota_type":0,"model_ratio":2,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.05,"create_cache_ratio":1.25,"enable_groups":["svip","default"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"doubao-seedance-1-5-pro-251215","description":"豆包视频生成模型Seedance 1.5 pro 作为全球领先的视频生成模型，可生成音画高精同步的视频内容。支持多人多语言对白，全面覆盖环境音、动作音、合成音、乐器音、背景音及人声，支持首尾帧，实现影视级叙事效果，满足影视、漫剧、电商及广告领域的高阶创作需求","tags":"国内闭源,文生音画,视觉模型,视频生成","vendor_id":5,"quota_type":0,"model_ratio":1.7391,"model_price":0,"owner_by":"","completion_ratio":1,"enable_groups":["default"],"supported_endpoint_types":["videos","task"]},{"model_name":"glm-5.3","description":"智谱最新旗舰模型，1M上下文，支持思考长度控制","tags":"国内开源,代码","vendor_id":7,"quota_type":0,"model_ratio":0.58910162,"model_price":0,"owner_by":"","completion_ratio":3.5,"cache_ratio":0.25,"enable_groups":["default","svip"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"gpt-5.3-chat-latest","description":"OpenAI 于 2026 年 3 月推出的 GPT-5.3 Instant 对话优化版本，是 ChatGPT 最常用模型的升级版。核心升级聚焦日常对话体验，大幅减少不必要的拒答与过度说教，回复更直接、聚焦重点。联网搜索能力显著提升，能结合自身推理与搜索结果，提供有背景分析的整合答案而非单纯复述链接。幻觉率在医学、法律等高风险领域降低 26.8%（联网时），用户反馈事实错误减少 22.5%。语气更自然，减少强势揣测与尴尬表达，写作能力更具细节与感染力。支持函数调用、结构化输出、多模态输入等 API 能力。","tags":" 文本生成, 多模态,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":0.875,"model_price":0,"owner_by":"","completion_ratio":8,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"grok-4.2","description":"Grok-4.2 是 xAI 公司推出的多智能体协作 AI 模型。其核心创新在于“4 Agents”系统，通过总指挥、研究员、逻辑专家和创意专家四个角色的内部辩论与协作，大幅提升了复杂任务处理的准确性与深度。","tags":" 文本生成,国外闭源","vendor_id":8,"quota_type":0,"model_ratio":1.25,"model_price":0,"owner_by":"","completion_ratio":4,"enable_groups":["default"],"supported_endpoint_types":["openai","openai-response"]},{"model_name":"deepseek-v4-flash","description":"DeepSeek-V4-Flash 是 DeepSeek-V4 系列中的预览版 MoE 语言模型，总参数量为 284B，激活参数量为 13B，支持 1M tokens 超长上下文。该模型采用结合 CSA 与 HCA 的混合注意力架构，并引入 mHC 与 Muon Optimizer，以提升长上下文推理效率、训练稳定性与整体性能。根据页面说明，模型经过超过 32T 高质量 tokens 的预训练，并支持 Non-think、Think High、Think Max 三种推理模式，适用于日常问答、复杂分析、长文本理解与代码等多类任务","tags":"国内开源,文本生成,代码","vendor_id":1,"quota_type":0,"model_ratio":0.220913105,"model_price":0,"owner_by":"","completion_ratio":3.000000045267,"cache_ratio":0.033333332579,"enable_groups":["default","svip"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-5.1","description":"OpenAI 于 2025 年 11 月 13 日发布的生成式预训练模型系列，包含 GPT-5.1 Instant（对话主力）和 GPT-5.1 Thinking（高阶推理）双模型架构。核心突破是自适应推理能力，模型可动态判断任务复杂度，简单查询快速响应，复杂问题自动投入更多思考时间。SWE-bench Verified 上得分约 76%，较 GPT-5 显著提升。支持 272K 输入 token、128K 输出 token 的超大上下文窗口，部分渠道可达 1M token 长上下文。支持 8 种人格预设与细粒度风格控制（简洁度、温暖度、表情符号频率等）。支持函数调用、结构化输出、联网搜索、多模态输入（图像）等完整 API 能力。适用于日常对话、复杂推理、代码生成、长文档处理等场景。","tags":" 文本生成, 多模态,代码,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":0.625,"model_price":0,"owner_by":"","completion_ratio":8,"cache_ratio":0.1,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"kimi-k2.6","description":"月之暗面于2026年4月21日发布并开源的新一代旗舰多模态智能体模型，是Kimi K2系列的最新演进，专注于代码生成、长程自主执行与多智能体协作能力。延续K2.5的MoE混合专家架构，总参数量1万亿，激活参数量约320亿，共384个专家，每token动态路由激活8个专家加1个共享专家，并采用MLA多头潜在注意力机制（KV缓存压缩约10倍）与SwiGLU激活函数。256K超大上下文窗口（262,144 tokens），原生多模态设计，集成MoonViT视觉编码器（4亿参数），支持文本、图像、视频输入及PDF文档理解。原生支持INT4量化，适用于vLLM、SGLang、KTransformers等主流推理框架高效部署。支持两种推理模式：Thinking模式（含完整思维链推理，推荐temperature 1.0）与Instant模式（低延迟响应，推荐temperature 0.6）；多轮工具调用中可通过preserve_thinking保留推理链。Agent能力全面升级：单次可持续执行4,000+次工具调用，连续运行12小时以上；Agent Swarm支持调度最多300个异构子Agent并行协作，单次任务最多4,000步，可从单一提示词自动生成100+文件的完整端到端输出（含文档、网站、幻灯片、表格等）。具备主动自主执行能力，可持续响应任务队列，并在遇到阻塞时自动重规划或上报。代码与智能体评测多项达开源模型最佳，SWE-Bench Pro得分58.6%，HLE with tools得分54.0%。以Modified MIT许可证开源，权重发布于Hugging Face（moonshotai/Kimi-K2.6），并可通过Moonshot API、Kimi.com、Kimi App、Kimi Code CLI、Ollama及Cloudflare Workers AI访问，适用于复杂代码工程、长程Agent任务、多智能体协作、视觉编程及办公自动化等场景。","tags":"多模态,国内开源,代码","vendor_id":9,"quota_type":0,"model_ratio":0.478645065,"model_price":0,"owner_by":"","completion_ratio":4.153846169917,"cache_ratio":0.169230770195,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"qwen-image-2512","description":"Qwen-Image 是阿里巴巴通义千问推出的图像生成模型，以其出色的中文文本渲染能力著称，能够精准生成汉字并理解复杂的中文语境。","icon":"Qwen.Color","tags":"国内开源, 文生图","vendor_id":2,"quota_type":1,"model_ratio":0,"model_price":0.075,"owner_by":"","completion_ratio":0,"enable_groups":["default"],"supported_endpoint_types":["path","method"]},{"model_name":"doubao-seedance-1-0-pro-fast-251015","description":"Seedance 1.0 pro fast是一款价格触底、效能封顶的全面模型，在视频生成质量、速度、价格之间取得了卓越平衡。它继承了Seedance 1.0 pro 核心优势，同时生成速度提升、价格更具竞争力，为创作者带来效率与成本双重优化的体验","tags":"国内闭源,文生视频,视觉模型","vendor_id":5,"quota_type":0,"model_ratio":0.4565217,"model_price":0,"owner_by":"","completion_ratio":1,"enable_groups":["default"],"supported_endpoint_types":["videos","task"]},{"model_name":"grok-4-1-fast-reasoning","description":"Grok-4-1-Fast-Reasoning 是 xAI 公司推出的高性能 AI 模型，专为需要深度逻辑分析、复杂问题拆解和多步骤推理的场景而设计。作为 Grok 4.1 系列的“推理”版本，它集成了 Agent Tools API，能够自主调用搜索、代码执行等工具，在保持高效的同时，提供卓越的推理能力，显著降低了事实性错误（幻觉）的发生率。","tags":"国外闭源,文本生成","vendor_id":8,"quota_type":0,"model_ratio":0.1,"model_price":0,"owner_by":"","completion_ratio":2.5,"enable_groups":["default"],"supported_endpoint_types":["openai","openai-response"]},{"model_name":"o3-mini","description":"OpenAI 于 2025 年 1 月推出的高性价比推理模型，是 o3 系列的轻量化版本。采用私有思维链推理机制，在数学、编程、科学等复杂推理任务上表现优异，同时大幅优化响应速度与成本。支持 low、medium、high 三档推理强度调节，开发者可根据任务复杂度灵活平衡性能与延迟。Codeforces 评分达 2130，AIME 2025 数学竞赛准确率 83.6%，博士级科学问题 GPQA Diamond 得分 73.8%。支持 200K 上下文窗口，支持函数调用与结构化输出。适用于中等复杂度推理任务、编程辅助、数学问题求解、科学问答等对成本敏感的场景。","tags":" 文本生成,代码,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":0.55,"model_price":0,"owner_by":"","completion_ratio":4,"cache_ratio":0.5,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"claude-opus-4-8","description":"Claude Opus 4.8 是由 Anthropic 发布的最新 AI 模型，主要提升了编程、智能体和复杂任务处理能力。与前代版本相比，Opus 4.8 引入了用户可控的“思考投入”机制，允许用户在速度、成本和推理深度之间进行权衡。此外，模型新增了“动态工作流”功能，能够处理超大规模的复杂问题。Opus 4.8 还在“诚实度”方面进行了改进，面对不确定信息时更倾向于主动标记疑点，减少了无依据结论的产生概率。","tags":"国外闭源,代码","vendor_id":3,"quota_type":0,"model_ratio":2.5,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"create_cache_ratio":1.25,"enable_groups":["svip","default"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"Qwen2.5-VL-7B-Instruct","description":"Qwen2.5-VL 是 Qwen 系列的新成员，具备强大的视觉理解能力，能分析图像中的文本、图表和布局，并能理解长视频和捕捉事件，它可以进行推理、操作工具，支持多格式物体定位和生成结构化输出，优化了视频理解的动态分辨率与帧率训练，并提升了视觉编码器效率。","tags":"国内开源,多模态,视觉模型","vendor_id":2,"quota_type":0,"model_ratio":0.1,"model_price":0,"owner_by":"","completion_ratio":1,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"happyhorse-1.0-video-edit","description":"HappyHorse 视频编辑模型支持输入视频与参考图，结合文本指令完成风格变换、局部替换等编辑任务。","tags":"视频编辑","vendor_id":2,"quota_type":0,"model_ratio":0.5,"model_price":0,"owner_by":"","completion_ratio":1,"enable_groups":["default"],"supported_endpoint_types":["video-generation"]},{"model_name":"kimi-k2.5","description":"之暗面于2026年1月27日发布并开源的旗舰多模态模型，是Kimi迄今最智能、最全能的模型。采用MoE混合专家架构，总参数量1万亿，激活参数量约328.6亿（激活率仅3.2%），每token动态路由激活8个专家加1个共享专家。原生多模态设计，集成MoonViT视觉编码器（4亿参数），支持图像、视频、文本输入及PDF文档理解。256K超大上下文窗口，采用MLA多头潜在注意力机制，KV缓存压缩约10倍。支持四种运行模式：Instant模式快速响应；Thinking模式输出推理链，AIME 2025数学竞赛得分96.1%；Agent模式支持200-300步工具调用；Agent Swarm（Beta）可动态调度最多100个子Agent并行处理1500步任务，实现集群式智能协作。编程能力突出，多项Agent评测获开源模型最佳。办公场景深度掌握Word、Excel、PPT、PDF操作，可自然语言完成复杂文档处理。已集成至NVIDIA NIM微服务，支持vLLM、SGLang、KTransformers等推理框架，适用于多模态Agent开发、视觉编程、智能体集群、办公自动化等场景。","tags":"国内开源, 文本生成, 多模态,代码","vendor_id":9,"quota_type":0,"model_ratio":0.29455081,"model_price":0,"owner_by":"","completion_ratio":5.250000008487,"cache_ratio":0.174999994059,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"o4-mini","description":"OpenAI 于 2025 年 4 月 17 日发布的高效推理模型，是 o3 的轻量级版本，在保持强大推理能力的同时显著优化速度与成本。核心突破是首次在思维链中集成图像推理能力，能够“用图像思考”——对模糊、颠倒的图片进行放大、旋转等处理后再分析。具备原生工具调用能力，可自主使用网络搜索、Python 代码执行、图像处理与生成等工具，在 AIME 2025 数学竞赛中配合 Python 解释器取得 99.5% 的近乎完美成绩。200K 上下文窗口，支持并行工具调用、函数调用与结构化输出。适用于高并发智能体应用、视觉问答、代码辅助、客户服务等需要快速响应与成本效益平衡的场景。","tags":" 文本生成, 多模态,国外闭源,代码","vendor_id":4,"quota_type":0,"model_ratio":0.55,"model_price":0,"owner_by":"","completion_ratio":4,"cache_ratio":0.25,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"glm-5.2","description":"GLM-5.2 是智谱AI在 2026 年推出的最新旗舰模型，继承了 GLM-5 系列的技术路线，采用 MoE（混合专家）稀疏架构和动态稀疏注意力机制，总参数约 744B，激活参数约 40B。该模型支持 纯文本与代码模态，并具备 1M Token 的真正可用上下文窗口，专为长程任务和复杂工程场景设计。","tags":"国内开源,代码","vendor_id":7,"quota_type":0,"model_ratio":0.58910162,"model_price":0,"owner_by":"","completion_ratio":3.5,"cache_ratio":0.25,"enable_groups":["svip","default"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"gpt-4o-2024-05-13","description":"penAI 于 2024 年 5 月 13 日发布的旗舰多模态模型稳定版本，“o”代表“omni”（全能），支持文本、图像、音频的实时输入与输出，端到端统一架构，音频响应低至 232 毫秒。128K 上下文窗口，知识截止至 2023 年 10 月，支持函数调用、JSON 模式、结构化输出等 API 能力。MMLU 基准得分 88.7%，多语言与视觉理解能力显著提升。适用于实时对话、图像理解、音频交互、代码生成、复杂推理等场景。定价 $2.50/百万输入 token、$10/百万输出 token。","tags":" 文本生成, 多模态,代码,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":2.5,"model_price":0,"owner_by":"","completion_ratio":3,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-5-chat-latest","description":"OpenAI GPT-5 系列的对话优化版本，专为 ChatGPT 即时对话体验设计，是 GPT-5 家族中的“非推理”变体。采用统一的运行时路由器架构，可根据任务复杂度动态选择响应路径，但该版本默认关闭耗时的思维链（CoT）内部推理流程，以优先保证响应速度与对话流畅性。上下文窗口支持输入 272K tokens、输出 128K tokens（总计约 400K tokens）。该版本调优聚焦于清晰、简洁、友好的对话风格，支持系统指令、多轮对话上下文管理、函数调用（工具调用）、结构化输出等 API 能力，并集成了更紧的安全启发式规则以减少有害输出。在编码、写作、知识问答等日常任务中表现优异，延迟和成本均低于推理变体。适用于智能客服、虚拟助手、聊天机器人等需要快速响应、高并发、面向用户的对话场景。","tags":" 文本生成,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":0.625,"model_price":0,"owner_by":"","completion_ratio":8,"cache_ratio":0.1,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-5-pro","description":"采用深度推理架构，内置完整的思维链（Chain of Thought）机制，可处理全球最复杂的推理任务，包括博士级科学问题、复杂数学证明、大规模代码重构与多步骤规划。上下文窗口扩展至 272K 输入、128K 输出，总计 400K token 处理能力。在 SWE-bench Verified 上得分 74.9%，推理任务表现较 GPT-5 标准版显著提升。支持深度推理模式、函数调用、结构化输出、多模态输入等完整 API 能力。适用于学术研究、复杂工程开发、高级数据分析、法律文书审查、医疗诊断辅助等专业场景。","tags":" 文本生成,代码,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":7.5,"model_price":0,"owner_by":"","completion_ratio":8,"enable_groups":["default"],"supported_endpoint_types":["path","method"]},{"model_name":"grok-4.1","description":"Grok-4.1 是 xAI 公司推出的旗舰级大语言模型，在对话智能、情感理解和现实世界实用性方面树立了新标准。该模型通过双变体架构（标准版与 Thinking 版）兼顾了响应速度与深度推理能力，在权威榜单中位居榜首，并显著降低了事实性幻觉的发生率。","tags":" 文本生成,国外闭源","vendor_id":8,"quota_type":0,"model_ratio":1,"model_price":0,"owner_by":"","completion_ratio":5,"enable_groups":["default"],"supported_endpoint_types":["openai","openai-response"]},{"model_name":"Qwen2.5-72B-Instruct","description":"Qwen2.5-72B-Instruct 是阿里云研发的旗舰级开源大模型。它在知识掌握、编程、数学及长文本生成方面表现卓越，在多项基准测试中性能超越了 Llama-3.1-405B 等更大规模的模型，是全球顶尖的开源语言模型之一。","icon":"Qwen.Color","tags":"国内开源, 文本生成,代码","vendor_id":2,"quota_type":0,"model_ratio":0.275,"model_price":0,"owner_by":"","completion_ratio":3,"cache_ratio":0.1,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"qwen3.7-max","description":"Qwen3.7 Max 是能力更强的旗舰级通用文本模型，适合复杂推理、高质量创作、深度问答、代码生成与复杂任务规划。","tags":"文本生成,代码,国内闭源","vendor_id":2,"quota_type":0,"model_ratio":0.885,"model_price":0,"owner_by":"","completion_ratio":2.994350282486,"cache_ratio":0.101694915254,"create_cache_ratio":1.248587570621,"enable_groups":["default","svip"],"supported_endpoint_types":["path","method"]},{"model_name":"text-embedding-3-small","description":"OpenAI 于 2024 年 1 月发布的第三代小型文本嵌入模型，具备 1,536 维向量输出能力，在保持高性能的同时大幅优化成本。在多语言 MTEB 基准上性能超越 text-embedding-ada-002，适用于语义搜索、聚类、分类、推荐系统、RAG 检索等场景。支持缩小嵌入维度（通过 dimensions 参数），开发者可灵活平衡存储成本与检索精度。","tags":" 文本嵌入,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":0.01,"model_price":0,"owner_by":"","completion_ratio":1,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-4o","description":"OpenAI 于 2024 年 5 月发布的旗舰多模态模型，“o”代表“omni”（全能），支持文本、图像、音频的实时输入与输出，端到端统一架构，音频响应低至 232 毫秒，情感表达与交互体验接近人类水平。128K 上下文窗口，知识截止至 2023 年 10 月，支持函数调用、JSON 模式、结构化输出等 API 能力。在 MMLU 基准上得分 88.7%，多语言与视觉理解能力显著提升。适用于实时对话、图像理解、音频交互、代码生成、复杂推理等场景。定价 $2.50/百万输入 token、$10/百万输出 token。","tags":" 文本生成, 多模态,代码,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":1.25,"model_price":0,"owner_by":"","completion_ratio":4,"cache_ratio":0.5,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"doubao-seedream-3-0-t2i-250415","description":"豆包文生图模型，原生 2K 分辨率直出，3 秒生成，支持中英双语。","tags":"国内闭源, 文生图, 多模态","vendor_id":5,"quota_type":1,"model_ratio":0,"model_price":0.036,"owner_by":"","completion_ratio":0,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"grok-4","description":"Grok-4 是 xAI 公司推出的旗舰级大语言模型，在多项权威基准测试中达到顶尖水平。它在数学、编程和科学推理等领域表现卓越，被评估为具备博士后级别的专业能力，并支持多模态输入与工具调用。","tags":" 文本生成, 多模态,国外闭源,代码","vendor_id":8,"quota_type":0,"model_ratio":1.5,"model_price":0,"owner_by":"","completion_ratio":5,"enable_groups":["default"],"supported_endpoint_types":["openai","openai-response"]},{"model_name":"claude-opus-4-7","description":"Anthropic 于2026年4月16日发布的当前最强旗舰级通用模型，是迄今正式公开可用的最强 Claude 模型。在软件工程、长程 Agent 任务、知识工作、视觉理解及长期记忆管理等方面全面超越前代。支持 100 万 token 超大上下文窗口，最大输出 128K tokens，可通过提示词缓存节省最高 90% 成本，批量处理节省 50%。视觉能力重大升级，图像分辨率上限提升至 2,576px（约 3.75MP），是前代的 3 倍以上，显著增强计算机操作、截图理解与文档处理能力。引入新增的 xhigh 推理级别（低/中/高/超高/最大），支持自适应思考（Adaptive Thinking），在开启 thinking 模式下内部评估表现超越扩展思考模式。采用全新 tokenizer，提升多语言与代码处理效率。Agent 能力强劲，能严格遵循复杂指令并在输出前自主校验结果，适合高强度、长时间运行的多步骤任务。编程基准 SWE-bench Verified 得分 87.6%（前代 80.8%），Terminal-Bench 2.0 得分 69.4%，GPQA Diamond 得分 94.2%，金融 Agent 任务达发布时最优水平。跨会话记忆管理能力提升，可在长程多轮工作中保持关键信息。可通过 Claude API、Amazon Bedrock、Google Vertex AI 及 Microsoft Foundry 访问，定价 $5/百万输入 tokens、$25/百万输出 tokens。适用于复杂软件工程、长程 Agent 工作流、高精度视觉分析及高要求企业级专业任务。","tags":"国外闭源,代码","vendor_id":3,"quota_type":0,"model_ratio":2.5,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"create_cache_ratio":1.25,"enable_groups":["default","svip"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"deepseek-r1","description":"DeepSeek-R1 是深度求索发布的推理模型，采用强化学习进行后训练，在数学、代码和自然语言推理等复杂任务上表现卓越。","icon":"DeepSeek.Color","tags":"国内开源, 文本生成,代码","vendor_id":1,"quota_type":0,"model_ratio":0.275,"model_price":0,"owner_by":"","completion_ratio":4,"cache_ratio":0.254545454545,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-5-2025-08-07","description":"OpenAI 于 2025年8月7日正式发布的旗舰模型，被 CEO Sam Altman 称为“世界上最好的模型”，是迈向通用人工智能（AGI）的重要一步。采用统一系统架构，整合高效基础模型与深度推理模块，内置实时路由器自动判断任务复杂度——简单问题快速响应，复杂问题自动切换至深度推理模式，无需用户手动选择模型。核心能力全面提升：编程方面，SWE-bench Verified 首次尝试准确率达 74.9%，可仅凭提示生成完整网站、游戏和应用程序；创意写作方面表现如诗人，能驾驭严格格律与自由诗；医疗领域在 HealthBench 基准刷新纪录，可解析医疗报告并提醒健康风险。上下文窗口大幅扩展至输入 272K、输出 128K，总处理能力达 40 万 token。幻觉率较 GPT-4o 降低 45%，深度推理模式下较 o3 模型降低 80%，诚实性显著提升，欺瞒行为从 4.8% 降至 2.1%。","tags":" 文本生成,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":0.625,"model_price":0,"owner_by":"","completion_ratio":8,"cache_ratio":0.1,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"imagen-doubao-seedream-4-0-250828","description":"豆包图像创作模型 Seedream 4.0，该模型首次支持 4K 多模态生图，灵活支持文本、图像的组合输入，实现多图融合创作、参考生图、组合生图、图像编辑等核心能力，且主体一致性大幅增强","tags":"国内闭源,文生图","vendor_id":5,"quota_type":1,"model_ratio":0,"model_price":0.028,"owner_by":"","completion_ratio":0,"enable_groups":["default"],"supported_endpoint_types":["image-generation","openai"]},{"model_name":"grok-3-mini","description":"Grok-3-mini 是 xAI 公司推出的轻量级 AI 模型，作为 Grok-3 的精简版，它在数学、科学和编程等基准测试中表现优异。该模型响应速度快、成本效益高，适用于数据抽取、简单逻辑任务及企业级应用，支持 API 调用。","tags":" 文本生成,国外闭源,代码","vendor_id":8,"quota_type":0,"model_ratio":0.15,"model_price":0,"owner_by":"","completion_ratio":1.67,"enable_groups":["default"],"supported_endpoint_types":["openai","openai-response"]},{"model_name":"Qwen3-VL-32B-Instruct","description":"Qwen3-VL-32B-Instruct 是阿里巴巴通义千问推出的高性能多模态视觉语言模型。它具备卓越的图文理解、复杂文档OCR及视觉推理能力，能够操作图形界面并深度分析视频内容，在多项评测中表现优于同级别模型。","icon":"Qwen.Color","tags":"国内开源, 多模态,视觉模型","vendor_id":2,"quota_type":0,"model_ratio":0.137,"model_price":0,"owner_by":"","completion_ratio":4,"cache_ratio":0.1,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"claude-opus-5","tags":"国外闭源","vendor_id":3,"quota_type":0,"model_ratio":2.5,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"create_cache_ratio":1.25,"enable_groups":["default","svip"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"deepseek-v3.2","description":"DeepSeek-V3.2 是一款兼具高计算效率与卓越推理和 Agent 性能的模型。其方法建立在三大关键技术突破之上：DeepSeek 稀疏注意力（DSA），一种高效的注意力机制，在保持模型性能的同时显著降低了计算复杂性，并特别针对长上下文场景进行了优化；可扩展的强化学习框架，通过该框架，模型性能可与 GPT-5 相媲美，其高算力版本在推理能力上可与 Gemini-3.0-Pro 匹敌；以及大规模 Agent 任务合成管线，旨在将推理能力整合到工具使用场景中，从而提高在复杂交互环境中的指令遵循和泛化能力。该模型在 2025 年国际数学奥林匹克（IMO）和国际信息学奥林匹克（IOI）中取得了金牌表现","tags":"国内开源,文本生成","vendor_id":1,"quota_type":0,"model_ratio":0.14,"model_price":0,"owner_by":"","completion_ratio":1.5,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"deepseek-v4-flash-vision-exp","description":"DeepSeek-V4-Flash-Vision-Exp是DeepSeek公司推出的一个实验性多模态视觉理解模型，于2026年8月21日上线DeepSeek API平台。该模型支持在文本之外输入图片，可以让模型描述图片、识别截图中的文字、分析图表等，支持的图片格式包括JPEG、PNG、GIF、Webp。","tags":"国内模型,视觉识别","vendor_id":1,"quota_type":0,"model_ratio":0.2209131,"model_price":0,"owner_by":"","completion_ratio":3.000000113167,"cache_ratio":0.033333333333,"enable_groups":["default","svip"],"supported_endpoint_types":["openai"]},{"model_name":"gemini-2.5-flash-image","description":"谷歌 Gemini 2.5 Flash 图像生成与编辑模型，社区昵称 \"Nano Banana\"。支持多图融合（最多3张）、基于自然语言对话式编辑、人物/品牌身份一致性保持，响应时间低于1秒。默认集成 SynthID 不可见水印，支持十种图像比例（21:9至4:5）。适用于快速图像生成、产品图编辑、广告素材制作等场景。按输出 Token 计费，单张约0.039美元","tags":" 文本生成, 图像生成, 图像编辑, 多模态,国外闭源","vendor_id":6,"quota_type":1,"model_ratio":0,"model_price":0.039,"owner_by":"","completion_ratio":0,"enable_groups":["default"],"supported_endpoint_types":["gemini","openai"]},{"model_name":"gpt-5.2-chat-latest","description":"OpenAI 于 2025 年 12 月发布的 GPT-5.2 系列对话优化版本，是 GPT-5.2 Instant 层级在 ChatGPT 产品中的对应模型。400K 超大上下文窗口，最大输出 128K token，知识截止至 2025 年 8 月 31 日。核心特性包括：自适应推理能力，简单查询快速响应，复杂问题自动投入更多思考时间；对话风格更温暖自然，指令遵循能力进一步优化；支持八种沟通风格预设（专业、友好、坦率、古怪、高效、书呆子、愤世嫉俗等）。支持函数调用、结构化输出、多模态输入（文本与图像）、联网搜索等 API 能力。适用于智能客服、虚拟助手、聊天机器人、内容创作等需要快速响应与自然对话交互的场景。","tags":" 文本生成, 多模态,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":0.875,"model_price":0,"owner_by":"","completion_ratio":8,"cache_ratio":0.1,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-5.3-codex-medium","description":"OpenAI GPT-5.3 系列编程标准版本，在性能与效率之间取得平衡，是 Codex 生态中最适合日常生产使用的模型。具备完整的仓库级代码理解与重构能力，支持跨文件依赖分析与多步骤规划，推理深度适中，响应延迟与成本均处于合理范围。支持多模态输入（文本与图像），可解析 UI 设计稿、架构图、流程图等视觉信息。支持函数调用、结构化输出、异步执行等 API 能力。适用于代码库维护、功能开发、测试编写、代码审查、中等规模项目重构等日常开发场景。注意：该模型仅支持 OpenAI Responses API（/v1/responses 端点），不支持标准 Chat Completions API。","tags":" 文本生成, 多模态,国外闭源,代码","vendor_id":4,"quota_type":0,"model_ratio":0.875,"model_price":0,"owner_by":"","completion_ratio":8,"cache_ratio":0.1,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-5.6-sol","tags":"国外闭源","vendor_id":4,"quota_type":0,"model_ratio":2,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"create_cache_ratio":1.25,"prompt_length_pricing":{"base":{"input_ratio":2,"completion_ratio":5,"cache_ratio":0.1,"cache_creation_ratio":1.25},"tiers":[{"threshold_tokens":272000,"input_ratio":4,"completion_ratio":3.75,"cache_ratio":0.1,"cache_creation_ratio":1.25}]},"enable_groups":["default","svip"],"supported_endpoint_types":["openai"]},{"model_name":"mureka-lyrics-gen","description":"Mureka-Lyrics-Gen是由中国昆仑万维打造的AI歌词生成模型，支持多语言、高质量原创音乐创作，并提供版权保护和商业使用权。","tags":"国内闭源,音乐","vendor_id":13,"quota_type":1,"model_ratio":0,"model_price":0.1159336,"owner_by":"","completion_ratio":0,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"claude-sonnet-4-6","description":"Claude Sonnet 4.6 是 Anthropic 推出的新一代高性能模型，被誉为“史上最强Sonnet”。它在计算机操作、编码、长上下文推理等方面全面升级，性能接近旗舰级 Opus 模型，但成本更低，实现了智能与性价比的卓越平衡。","icon":"Claude.Color","tags":" 文本生成,国外闭源,代码","vendor_id":3,"quota_type":0,"model_ratio":1.5,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"create_cache_ratio":1.25,"enable_groups":["default","svip"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"doubao-seedance-1-0-pro-250528","description":"字节跳动豆包视频生成大模型 Seedance 1.0 Pro，发布于 2025 年 6 月，在国际评测榜单 Artificial Analysis 文生视频、图生视频双项排名首位。支持文生视频、图生视频（首帧/Base64）、首尾帧生成、多图参考生成等多种模式。核心能力包括：无缝多镜头叙事、多动作控制、随心运镜、复杂场景主体一致性保持、大幅运动的物理合理性、视频节奏智能推理。可生成 1080P 高品质视频，输出时长 4-12 秒，支持 16:9、9:16、1:1 等多种宽高比。适用于广告素材制作、影视分镜预览、创意内容生成等专业视频创作场景。按输出 token 计费，定价 0.015 元/千 tokens。","tags":"国内闭源, 文生视频,视觉模型","vendor_id":5,"quota_type":0,"model_ratio":1.630434,"model_price":0,"owner_by":"","completion_ratio":1,"enable_groups":["default"],"supported_endpoint_types":["videos","task"]},{"model_name":"gpt-4.1-nano","description":"OpenAI GPT-4.1 系列中速度最快、成本最低的轻量级模型，100 万 token 超大上下文窗口，支持多模态输入（文本与图像），知识截止至 2024 年 6 月。专为低延迟、高吞吐量场景优化，定价 $0.10/百万输入 token、$0.40/百万输出 token，适用于轻量级对话、文本分类、内容过滤、数据清洗等对成本极度敏感的任务。支持函数调用、结构化输出等 API 能力。","tags":" 文本生成, 多模态,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":0.05,"model_price":0,"owner_by":"","completion_ratio":4,"cache_ratio":0.25,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-image-1","description":"OpenAI 于 2025 年 4 月推出的原生多模态图像生成模型，通过 Images API 开放，是 ChatGPT 图像生成功能背后的核心技术。支持文本生成图像、图像编辑、图像变体、多图融合与蒙版编辑等能力，可生成写实、插画、3D 渲染等多种视觉风格，文字渲染准确度显著提升。支持 1024×1024、1024×1536、1536×1024 等多种分辨率，提供低、中、高三档质量调节，可输出 PNG、JPEG、WebP 格式并支持透明背景。开发者可调整内容审核敏感度（auto/low），所有生成图像均嵌入 C2PA 元数据水印以便识别 AI 来源。","tags":" 图像生成, 文生图, 图像编辑, 多模态,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":2.5,"model_price":0,"owner_by":"","completion_ratio":8,"cache_ratio":0.25,"create_cache_ratio":2,"image_ratio":2,"enable_groups":["default"],"supported_endpoint_types":["path","method"]},{"model_name":"gpt-image-2","description":"OpenAI 最新一代图像生成模型，支持文本生成图像、图像编辑与蒙版修复等核心能力。在图像质量、细节真实感与文字渲染精准度上全面超越 gpt-image-1，支持写实摄影、插画、3D 渲染等多种视觉风格。支持 1024×1024、1024×1536、1536×1024 分辨率输出，提供低、中、高三档质量调节，可输出 PNG、JPEG、WebP 格式并支持透明背景。所有生成图像均嵌入 C2PA 元数据水印以标识 AI 来源。","tags":" 图像生成,多模态,图像编辑,国外闭源","vendor_id":4,"quota_type":1,"model_ratio":0,"model_price":0.042,"owner_by":"","completion_ratio":0,"enable_groups":["default"],"supported_endpoint_types":["path","method"]},{"model_name":"o3-2025-04-16","description":"OpenAI 于 2025 年 4 月 16 日发布的推理模型，是 OpenAI 首个在 ARC 评估中超越人类水平的模型。采用私有思维链推理机制，在回答前进行内部思考，在数学、编程、科学等复杂推理任务上表现卓越。Codeforces 评分达 2727，位列全球前 50，AIME 2025 数学竞赛准确率 96.7%，博士级科学问题 GPQA Diamond 得分 87.7%。支持 200K 上下文窗口，支持函数调用与结构化输出。适用于复杂数学证明、高级编程竞赛、科学推理、多步骤规划等深度推理场景","tags":" 文本生成,代码,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":5,"model_price":0,"owner_by":"","completion_ratio":4,"cache_ratio":0.25,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-4-turbo","description":"OpenAI GPT-4 Turbo 系列模型，128K 上下文窗口，知识截止至 2023 年 12 月，支持函数调用、JSON 模式、并行工具调用，性能更优、成本更低，适用于长文本处理、复杂推理、代码生成等各类高级任务。","tags":" 文本生成,代码,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":5,"model_price":0,"owner_by":"","completion_ratio":3,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-image-2-all","description":"OpenAI GPT Image 2 全能版，集成图像生成、图像编辑、图像变体、多图融合与蒙版修复等全系能力于一体。相比 gpt-image-1，在图像质量、细节真实感与文字渲染精准度上全面提升，支持写实摄影、插画、3D 渲染、概念设计等多种视觉风格。支持 1024×1024、1024×1536、1536×1024 多种分辨率输出，提供低、中、高三档质量调节，可输出 PNG、JPEG、WebP 格式并支持透明背景（Alpha 通道）。所有生成图像均嵌入 C2PA 元数据水印以标识 AI 来源。适用于电商素材生成、品牌视觉设计、内容创作、产品效果图、营销海报等多种商业与创意场景。","tags":" 图像生成, 图像编辑, 多模态,国外闭源","vendor_id":4,"quota_type":1,"model_ratio":0,"model_price":0.042,"owner_by":"","completion_ratio":0,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"qwen3.7-plus","description":"Qwen3.7 Plus 是面向综合应用场景的高性能通用文本模型，在对话、写作、推理、代码辅助和结构化输出任务中具有较好的平衡表现。","tags":"文本生成,代码,国内闭源","vendor_id":2,"quota_type":0,"model_ratio":0.145,"model_price":0,"owner_by":"","completion_ratio":4.068965517241,"cache_ratio":0.1,"create_cache_ratio":1.275862068966,"enable_groups":["default","svip"],"supported_endpoint_types":["path","method"]},{"model_name":"claude-opus-4-5-20251101-thinking","description":"Claude Opus 4.5（扩展思考版）是 Anthropic 发布的新一代旗舰级模型，具备深度推理能力，通过延长思考时间来处理高度复杂的任务。","icon":"Claude.Color","tags":" 文本生成,国外闭源","vendor_id":3,"quota_type":0,"model_ratio":2.5,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"create_cache_ratio":1.25,"enable_groups":["default"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"grok-4.1-thinking","description":"Grok-4.1-Thinking 是 xAI 公司推出的旗舰级 AI 模型，作为 Grok 4.1 的增强推理变体，它在逻辑推理、情感理解和创意写作等多个维度均达到顶尖水平。该模型通过“思考令牌”进行链式推理，擅长处理复杂的数学、编程及多步骤问题，在权威榜单中表现卓越。","tags":"国外闭源,文本生成","vendor_id":8,"quota_type":0,"model_ratio":1,"model_price":0,"owner_by":"","completion_ratio":5,"enable_groups":["default"],"supported_endpoint_types":["openai","openai-response"]},{"model_name":"happyhorse-1.0-t2v","description":"HappyHorse文生视频模型，输入文本提示词生成物理真实、运动流畅的视频内容。","tags":"文生视频","vendor_id":2,"quota_type":0,"model_ratio":0.5,"model_price":0,"owner_by":"","completion_ratio":1,"enable_groups":["default"],"supported_endpoint_types":["video-generation"]},{"model_name":"mureka-8","description":"Mureka-8 是由中国昆仑万维打造的一体化智能音乐模型，可直接发布的音乐,富有情感的人声，有记忆度的旋律。支持指定歌曲风格，为歌曲录制旋律动机，支持完整歌曲下载，并默认生成歌词。","tags":"国内闭源,音乐","vendor_id":13,"quota_type":1,"model_ratio":0,"model_price":0.4782262,"owner_by":"","completion_ratio":0,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"qwen3-tts","description":"Qwen3-TTS VoiceDesign 语音合成模型，支持通过自然语言描述控制音色、情感和语速，覆盖中英日韩等10种语言，本地部署低延迟。","tags":"国内开源, 语音合成","vendor_id":2,"quota_type":0,"model_ratio":5.515,"model_price":0,"owner_by":"","completion_ratio":1,"enable_groups":["default"],"supported_endpoint_types":["path","method"]},{"model_name":"qwen3.6-flash","description":"Qwen3.6 Flash 是一款面向低延迟、高吞吐场景的轻量级通用大语言模型，适合日常对话、内容生成、摘要改写、代码辅助与结构化任务处理，在响应速度和成本控制上表现更优。","tags":"文本生成,代码,国内闭源","vendor_id":2,"quota_type":0,"model_ratio":0.09,"model_price":0,"owner_by":"","completion_ratio":5.888888888889,"cache_ratio":0.1,"create_cache_ratio":1.222222222222,"enable_groups":["default","svip"],"supported_endpoint_types":["path","method"]},{"model_name":"MiniMax-M2.7","description":"MiniMax M2.7 是 MiniMax 公司于 2026 年推出的旗舰大语言模型，支持自我进化、多智能体协作和百万 token 超长上下文，专注于生产力和复杂任务执行。","tags":"国内开源,文本生成,代码","vendor_id":11,"quota_type":0,"model_ratio":0.1546391755,"model_price":0,"owner_by":"","completion_ratio":3.999999993533,"cache_ratio":0.199999999353,"enable_groups":["default","svip"],"supported_endpoint_types":["openai"]},{"model_name":"qwen3-vl-32b-instruct","vendor_id":2,"quota_type":0,"model_ratio":37.5,"model_price":0,"owner_by":"","completion_ratio":1,"enable_groups":["default","svip"],"supported_endpoint_types":["openai"]},{"model_name":"mureka-lyrics-ext","description":"Mureka-Lyrics-Ext是由中国昆仑万维打造的AI歌词扩展模型，支持多语言、高质量原创音乐创作，并提供版权保护和商业使用权。","tags":"国内闭源,音乐","vendor_id":13,"quota_type":1,"model_ratio":0,"model_price":0.0289834,"owner_by":"","completion_ratio":0,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"claude-opus-4-1-20250805-thinking","description":"Claude Opus 4.1（扩展思考版）是由 Anthropic 提供的高级人工智能模型，具备深度推理能力，通过延长思考时间来处理高度复杂的任务。","icon":"Claude.Color","tags":" 文本生成,国外闭源","vendor_id":3,"quota_type":0,"model_ratio":7.5,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"create_cache_ratio":1.25,"enable_groups":["default"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"doubao-seedance-2-0-fast-260128","description":"Seedance 2.0 fast是豆包大模型团队推出的新一代多模态视频创作模型，它继承了Seedance 2.0模型的核心功能和优势，生成速度更快","tags":"国内闭源, 参考图片/视频/音频生视频,编辑视频,视觉模型","vendor_id":5,"quota_type":0,"model_ratio":4.021725,"model_price":0,"owner_by":"","completion_ratio":1,"enable_groups":["default"],"supported_endpoint_types":["videos","task"]},{"model_name":"glm-5.3-flash","description":"GLM-5.3-Flash 是 GLM-5 系列首个原生多模态模型，以极致低成本架构实现超越 GLM-5.2 的更强智能","tags":"国内开源,代码","vendor_id":7,"quota_type":0,"model_ratio":0.05891016,"model_price":0,"owner_by":"","completion_ratio":3.500000118825,"cache_ratio":0.287500008488,"enable_groups":["default","svip"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"gpt-5.6-terra","tags":"国外闭源","vendor_id":4,"quota_type":0,"model_ratio":1,"model_price":0,"owner_by":"","completion_ratio":6,"cache_ratio":0.1,"create_cache_ratio":1.25,"prompt_length_pricing":{"base":{"input_ratio":1,"completion_ratio":6,"cache_ratio":0.1,"cache_creation_ratio":1.25},"tiers":[{"threshold_tokens":272000,"input_ratio":2,"completion_ratio":4.5,"cache_ratio":0.1,"cache_creation_ratio":1.25}]},"enable_groups":["default","svip"],"supported_endpoint_types":["openai"]},{"model_name":"o3-mini-2025-01-31","description":"OpenAI 于 2025 年 1 月 31 日发布的高性价比推理模型稳定版本，是 o3 系列的轻量化版本。采用私有思维链推理机制，在数学、编程、科学等复杂推理任务上表现优异，同时大幅优化响应速度与成本。支持 low、medium、high 三档推理强度调节，开发者可根据任务复杂度灵活平衡性能与延迟。Codeforces 评分达 2130，AIME 2025 数学竞赛准确率 83.6%，博士级科学问题 GPQA Diamond 得分 73.8%。支持 200K 上下文窗口，支持函数调用与结构化输出。适用于中等复杂度推理任务、编程辅助、数学问题求解、科学问答等对成本敏感的场景。","tags":" 文本生成,代码,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":0.55,"model_price":0,"owner_by":"","completion_ratio":4,"cache_ratio":0.5,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gemini-3-flash-preview","description":"Gemini 2.5 Pro Thinking 是 Google 推出的深度推理版旗舰 AI 模型。它强化了“思考”机制，能够在回答前进行多步骤的深度推理与假设权衡，在数学、代码和复杂逻辑任务上表现尤为出色。该模型支持高达 200 万 Token 的超长上下文窗口，能够处理完整的代码库或海量文档，适合需要极致智能和深度分析能力的高难度应用场景。","tags":"国外闭源,文本生成","vendor_id":6,"quota_type":0,"model_ratio":0.25,"model_price":0,"owner_by":"","completion_ratio":6,"enable_groups":["default"],"supported_endpoint_types":["gemini","openai"]},{"model_name":"gpt-5-nano-2025-08-07","description":"OpenAI 于 2025 年 8 月 7 日发布的 GPT-5 系列超轻量级版本，是 GPT-5 家族中速度最快、成本最低的模型。128K 上下文窗口，知识截止至 2025 年 5 月，支持文本与图像多模态输入。专为低延迟、高吞吐量场景优化，适用于轻量级对话、文本分类、内容过滤、数据清洗、实体提取等对成本极度敏感的任务。","tags":" 文本生成, 多模态,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":0.025,"model_price":0,"owner_by":"","completion_ratio":8,"cache_ratio":0.1,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"qwen3.6-plus","description":"Qwen3.6 Plus 是兼顾能力、速度与成本的通用文本模型，适合复杂对话、长文本写作、知识问答、代码辅助和办公生产力场景。","tags":"文本生成,代码,国内闭源","vendor_id":2,"quota_type":0,"model_ratio":0.145,"model_price":0,"owner_by":"","completion_ratio":6.103448275862,"cache_ratio":0.1,"create_cache_ratio":1.275862068966,"enable_groups":["svip","default"],"supported_endpoint_types":["path","method"]},{"model_name":"deepseek-chat-v3.1","description":"DeepSeek-V3.1 是深度求索发布的新一代基础模型，采用混合推理架构，支持思考与非思考模式，拥有强大的智能体（Agent）能力和128K超长上下文窗口。","icon":"DeepSeek.Color","tags":"国内开源, 文本生成,代码","vendor_id":1,"quota_type":0,"model_ratio":0.28,"model_price":0,"owner_by":"","completion_ratio":3,"cache_ratio":0.25,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gemini-3.1-flash-lite","description":"Gemini 3.1 Flash-Lite 是 Google 推出的轻量级 AI 模型的预览版本。作为 Gemini 3.1 家族中速度最快、成本最低的模型，它在保持高效响应的同时，在代码、推理和多模态能力上相比前代有显著提升。该模型支持百万级 Token 上下文，是处理高频、延迟敏感型任务（如翻译、分类、实时对话）的理想选择。","tags":" 多模态,国外闭源","vendor_id":6,"quota_type":0,"model_ratio":0.125,"model_price":0,"owner_by":"","completion_ratio":6,"enable_groups":["default"],"supported_endpoint_types":["gemini","openai"]},{"model_name":"gpt-5.3-codex","description":"OpenAI 于 2026 年 3 月推出的 GPT-5.3 系列编程优化模型，专为智能体编程任务设计。核心能力包括：仓库级代码理解与重构，支持跨文件依赖分析与多步骤规划；多模态输入，可解析 UI 设计稿、架构图、流程图等视觉信息；异步执行与长时任务保持，支持复杂项目的持续运行。采用自适应推理机制，可根据任务复杂度动态分配计算资源，简单任务快速响应，复杂任务深度思考。支持函数调用、结构化输出等完整 API 能力。适用于复杂代码库重构、大型项目迁移、智能体自动化开发、测试生成、代码审查等场景。注意：该模型仅支持 OpenAI Responses API（/v1/responses 端点），不支持标准 Chat Completions API","tags":" 文本生成, 多模态,代码,国外闭源","vendor_id":4,"quota_type":0,"model_ratio":0.875,"model_price":0,"owner_by":"","completion_ratio":8,"cache_ratio":0.1,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-6.1-sol","tags":"海外模型","vendor_id":4,"quota_type":0,"model_ratio":1,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.05,"create_cache_ratio":1.25,"prompt_length_pricing":{"base":{"input_ratio":1,"completion_ratio":5,"cache_ratio":0.05,"cache_creation_ratio":1.25},"tiers":[{"threshold_tokens":272000,"input_ratio":2,"completion_ratio":3.75,"cache_ratio":0.05,"cache_creation_ratio":1.25}]},"enable_groups":["default","svip"],"supported_endpoint_types":["openai"]},{"model_name":"grok-3-deepsearch","description":"Grok-3-DeepSearch 是 xAI 公司为 Grok-3 模型推出的高级推理与搜索功能。它通过实时扫描互联网和 X 平台，结合“思维链”技术展示透明的推理路径，生成具备逻辑支撑的结构化摘要，特别适用于学术研究、商业决策等复杂查询场景。","tags":"国外闭源,文本生成","vendor_id":8,"quota_type":0,"model_ratio":3,"model_price":0,"owner_by":"","completion_ratio":3,"enable_groups":["default"],"supported_endpoint_types":["openai","openai-response"]},{"model_name":"deepseek-v3.2-thinking","description":"DeepSeek-V3.2-thinking 是一款兼具高计算效率与卓越推理和 Agent 性能的模型。其方法建立在三大关键技术突破之上：DeepSeek 稀疏注意力（DSA），一种高效的注意力机制，在保持模型性能的同时显著降低了计算复杂性，并特别针对长上下文场景进行了优化；可扩展的强化学习框架，通过该框架，模型性能可与 GPT-5 相媲美，其高算力版本在推理能力上可与 Gemini-3.0-Pro 匹敌；以及大规模 Agent 任务合成管线，旨在将推理能力整合到工具使用场景中，从而提高在复杂交互环境中的指令遵循和泛化能力。该模型在 2025 年国际数学奥林匹克（IMO）和国际信息学奥林匹克（IOI）中取得了金牌表现","tags":"国内开源,文本生成","vendor_id":1,"quota_type":0,"model_ratio":0.14,"model_price":0,"owner_by":"","completion_ratio":1.5,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gemini-2.5-flash-image-preview","description":"谷歌 Gemini 2.5 Flash 图像生成与编辑模型预览版，社区昵称 \"Nano Banana\"。支持多图融合（最多3张）、基于自然语言对话式编辑、人物/品牌身份一致性保持，响应时间低于1秒。预览版可提前体验最新图像生成与编辑能力，适用于快速图像生成、产品图编辑、广告素材制作等场景。按输出 Token 计费，单张约0.039美元。","tags":" 文本生成, 图像编辑, 多模态,国外闭源","vendor_id":6,"quota_type":1,"model_ratio":0,"model_price":0.039,"owner_by":"","completion_ratio":0,"enable_groups":["default"],"supported_endpoint_types":["gemini","openai"]},{"model_name":"gemini-3.1-pro-preview","description":"Gemini 3.1 Pro Preview 是 Google 推出的旗舰级 AI 模型的预览版本。作为 Gemini 3.1 系列的核心模型，它在推理能力、代码生成、多模态理解和长上下文处理方面实现了全面升级。该模型支持高达 200 万 Token 的超长上下文窗口，具备更强大的\"思考\"机制，在复杂任务处理和企业级应用场景中表现卓越。","tags":" 多模态,国外闭源","vendor_id":6,"quota_type":0,"model_ratio":1,"model_price":0,"owner_by":"","completion_ratio":6,"enable_groups":["default"],"supported_endpoint_types":["gemini","openai"]},{"model_name":"doubao-seededit-3-0-i2i-250628","description":"豆包图像创作模型，原生 4K 直出，1.8 秒生成 2K，支持多图融合与组图生成。","tags":"国内闭源, 文生图, 图生图, 多模态,代码","vendor_id":5,"quota_type":1,"model_ratio":0,"model_price":0.04,"owner_by":"","completion_ratio":0,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gemini-2.5-pro-thinking","description":"Gemini 2.5 Pro Thinking 是 Google 推出的深度推理版旗舰 AI 模型。它强化了“思考”机制，能够在回答前进行多步骤的深度推理与假设权衡，在数学、代码和复杂逻辑任务上表现尤为出色。该模型支持高达 200 万 Token 的超长上下文窗口，能够处理完整的代码库或海量文档，适合需要极致智能和深度分析能力的高难度应用场景。","tags":"代码,国外闭源","vendor_id":6,"quota_type":0,"model_ratio":0.625,"model_price":0,"owner_by":"","completion_ratio":8,"enable_groups":["default"],"supported_endpoint_types":["gemini","openai"]},{"model_name":"gpt-5.5","description":"OpenAI GPT-5.5 系列旗舰版本，面向企业高负载场景与高阶专业用户，顶配释放全域智能能力与超大吞吐体量。核心搭载原生全域智能体操控能力，可依托视觉识图自主解析界面逻辑，精准模拟键鼠操作，跨软件、跨系统全自动串联复杂业务工作流，在权威智能体操作基准测试中大幅刷新纪录，综合表现超越常规专业人力水平。内置100 万 Token 超大上下文窗口，可一次性承载超长卷宗、完整项目资料与海量知识库，胜任深度文档拆解与大型项目全局规划","tags":"国外闭源,代码","vendor_id":4,"quota_type":0,"model_ratio":2.5,"model_price":0,"owner_by":"","completion_ratio":6,"cache_ratio":0.1,"create_cache_ratio":1,"prompt_length_pricing":{"base":{"input_ratio":2.5,"completion_ratio":6,"cache_ratio":0.1,"cache_creation_ratio":1},"tiers":[{"threshold_tokens":272000,"input_ratio":5,"completion_ratio":4.5,"cache_ratio":0.1,"cache_creation_ratio":1}]},"enable_groups":["default","svip"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-6-sol","tags":"国外模型","vendor_id":4,"quota_type":0,"model_ratio":1,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"create_cache_ratio":1.25,"prompt_length_pricing":{"base":{"input_ratio":1,"completion_ratio":5,"cache_ratio":0.1,"cache_creation_ratio":1.25},"tiers":[{"threshold_tokens":272000,"input_ratio":2,"completion_ratio":3.75,"cache_ratio":0.1,"cache_creation_ratio":1.25}]},"enable_groups":["svip","default"],"supported_endpoint_types":["0"]}],"group_ratio":{"default":1,"vip":1},"pricing_version":"a42d372ccf0b5dd13ecf71203521f9d2","success":true,"supported_endpoint":{"0":{"path":"openai","method":"POST"},"anthropic":{"path":"/v1/messages","method":"POST"},"gemini":{"path":"/v1beta/models/{model}:generateContent","method":"POST"},"image-generation":{"path":"/v1/images/generations","method":"POST"},"method":{"path":"\tPOST","method":"POST"},"openai":{"path":"/v1/audio/transcriptions","method":"POST"},"openai-response":{"path":"/v1/responses","method":"POST"},"path":{"path":"/v1/images/generations","method":"POST"},"task":{"path":"{   \"path\": \"/api/v3/contents/generations/tasks\",   \"method\": \"POST\" }","method":"POST"},"video-generation":{"path":"{   \"path\": \"kling/v1/videos/omni-video\",   \"method\": \"POST\" }","method":"POST"},"videos":{"path":"{   \"path\": \"/v1/videos\",   \"method\": \"POST\" }","method":"POST"}},"usable_group":{"default":"默认分组","vip":"vip分组"},"vendors":[{"id":9,"name":"Moonshot","icon":"Moonshot"},{"id":11,"name":"MiniMax","icon":"MiniMax"},{"id":13,"name":"Mureka","icon":"Mureka"},{"id":3,"name":"Anthropic","icon":"Claude.Color"},{"id":4,"name":"OpenAI","icon":"OpenAI"},{"id":6,"name":"Google","icon":"Gemini.Color"},{"id":7,"name":"Zhipu AI","icon":"Zhipu.Color"},{"id":8,"name":"xAI","icon":"XAI"},{"id":10,"name":"ChatTTS","icon":"ChatTTS.Avatar.shape={'square'}.type={'brand'}"},{"id":12,"name":"Kwai","icon":"Kling.Color"},{"id":1,"name":"DeepSeek","icon":"DeepSeek.Color"},{"id":2,"name":"Alibaba","icon":"Qwen.Color"},{"id":5,"name":"ByteDance","icon":"Doubao.Color"}]}