平台支持的 LLM 清单
AIP 支持来自 xAI、OpenAI、Anthropic、Meta、Google 等提供商的多种 LLM 与文本嵌入模型。这一篇是选型参照表。
https://www.palantir.com/docs/foundry/aip/supported-llms/
原始标题:Supported LLMs • Palantir · 所属:核心平台(AIP 总览与治理)
先记住这几条
写在前面
Palantir AIP 支持来自领先提供商(包括 xAI、OpenAI、Anthropic、Meta 和 Google)的多种 LLM(大语言模型)和文本嵌入模型。受支持的模型列于本页,可在整个 Palantir 平台中使用,以驱动 AIP 工作流;不过各 enrollment 的可用性可能不同(例如因地理限制而不同)。
Enrollment 管理员通过 Control Panel 管理模型家族。当启用某个子处理者(subprocessor)时,Palantir 可能会在已接受条款和条件的前提下,启用符合资格要求的其他模型家族。了解如何配置你的 enrollment 上可供使用的 LLM 选择。
可用的 LLM
以下 LLM 受支持,可与 AIP 配合使用,具体取决于 enrollment 的可用性。
- Grok-3 ↗
- Grok-3-Mini-Reasoning ↗
- Grok-4 ↗
- Grok-4-Fast (Reasoning) ↗
- Grok-4-Fast (Non-Reasoning) ↗
- Grok-4-1-Fast (Reasoning) ↗
- Grok-4-1-Fast (Non-Reasoning) ↗
- Grok-Code-Fast-1 ↗
- GPT-4o ↗
- GPT-4o mini ↗
- GPT-4.1 ↗
- GPT-4.1 mini ↗
- GPT-4.1 nano ↗
- GPT-5 ↗
- GPT-5 Pro ↗
- GPT-5 Codex ↗
- GPT-5 mini ↗
- GPT-5 nano ↗
- GPT-5.1 ↗
- GPT-5.1 Codex↗
- GPT-5.1 Codex Max↗
- GPT-5.1 Codex Mini↗
- GPT-5.2 ↗
- GPT-5.2 Codex ↗
- GPT-5.3 Codex ↗
- GPT-5.4 ↗
- GPT-5.4 mini ↗
- GPT-5.4 nano ↗
- GPT-5.5 ↗
- o1 ↗
- o3-mini ↗
- o3 ↗
- o4-mini ↗
- Anthropic Claude 3 Haiku ↗
- Anthropic Claude 3.5 Haiku ↗
- Anthropic Claude 3.5 Sonnet ↗
- Anthropic Claude 3.5 Sonnet v2 ↗
- Anthropic Claude 3.7 Sonnet ↗
- Anthropic Claude 4 Sonnet ↗
- Anthropic Claude 4 Opus ↗
- Anthropic Claude 4.1 Opus ↗
- Anthropic Claude 4.5 Haiku ↗
- Anthropic Claude 4.5 Sonnet ↗
- Anthropic Claude 4.5 Opus ↗
- Anthropic Claude 4.6 Sonnet ↗
- Anthropic Claude 4.6 Opus ↗
- Anthropic Claude 4.7 Opus ↗
- Anthropic Claude 4.8 Opus ↗
- Mistral 7B ↗
- Mixtral 8X7B ↗
- Mistral Small 24B ↗
- Llama 3_8B ↗
- Llama 3_70B ↗
- Llama 3.1_8B ↗
- Llama 3.1_70B ↗
- Llama 3.2 NV EmbedQA 1B v2 ↗
- Llama 3.3_70B ↗
- Llama 3.3 Nemotron Super 49b v1.5 ↗
- Llama 4_16B Scout ↗
- Llama 4_128B Maverick ↗
- Gemma 4 26B A4B ↗
- Gemini 2.0 Flash ↗
- Gemini 2.5 Pro ↗
- Gemini 2.5 Flash ↗
- Gemini 2.5 Flash Lite ↗
- Gemini 3 Flash ↗
- Gemini 3.1 Pro ↗
- Gemini 3.1 Flash-Lite ↗
- Gemini 3.5 Flash ↗
- Gemini 3.5 Flash-Lite ↗
- Gemini 3.6 Flash ↗
- Gemini 3.7 Flash ↗
可用的文本嵌入模型
Palantir AIP 还支持以下文本嵌入模型:
可用的音频模型
在部署任何录制或转写人类语音的应用之前,请确保已通知参与者,并在你所在司法管辖区要求的情况下准备好同意确认流程。无论被录音者是应用用户、通话中的第三方,还是其他任何被采集到声音的人,这一点都可能适用。参见录音、转写与同意。
Palantir AIP 支持两类音频模型:用于构建对话式语音应用的实时语音到语音(speech-to-speech)模型,以及用于将音频转换为文本的转写模型。如需了解如何在以 Foundry 用户身份认证的浏览器应用中使用音频模型,请参见构建支持语音的 OSDK 应用。如需了解 Foundry 上音频的总体概况,请参见实时音频。
Mode 列指明每个模型支持哪些使用路径:
- Realtime: 流式双向 WebSocket。模型负责语音活动检测、轮流发言和流式输出;应用在采集音频时即发送原始音频。
- Static: 请求-响应式 HTTP。应用发送一段有界的音频负载,并收到转写结果。适用于转写此前录制的音频文件。如果应用自行进行音频分块,也可用于实时转写——这是一种权衡:以增加应用复杂度换取更低且更可预测的每分钟成本。当你的 enrollment 上没有可用的实时模型时,这种方式也有帮助。延迟取决于分块大小和模型,因此请针对你的用例进行评估。
Realtime speech-to-speech
实时语音到语音模型接受流式音频输入,在对话过程中进行工具调用,并通过 WebSocket 连接返回流式音频输出。
| Model | API name | Provider | Mode |
|---|---|---|---|
| GPT Realtime 1.5 ↗ | gpt-realtime-1.5 | OpenAI Direct, Azure OpenAI | Realtime |
| GPT Realtime 2.0 ↗ | gpt-realtime-2 | OpenAI Direct | Realtime |
Transcription
转写模型将音频转换为文本。大多数模型同时支持实时(流式 WebSocket)和静态(请求-响应式 HTTP)模式;Whisper_large_v3 由 Palantir 托管,仅支持静态模式。
| Model | API name | Provider | Mode |
|---|---|---|---|
| Whisper 1 ↗ | whisper-1 | OpenAI Direct, Azure OpenAI | Realtime, Static |
| GPT-4o Transcribe ↗ | gpt-4o-transcribe | OpenAI Direct, Azure OpenAI | Realtime, Static |
| GPT-4o Mini Transcribe ↗ | gpt-4o-mini-transcribe | OpenAI Direct, Azure OpenAI | Realtime, Static |
| GPT-4o Transcribe Diarize ↗ | gpt-4o-transcribe-diarize | OpenAI Direct, Azure OpenAI | Realtime, Static |
| Whisper Large V3 ↗ | Whisper_large_v3 | Palantir-hosted | Static |
当你需要对会议等多说话人音频进行说话人分离(diarization)时,请使用 gpt-4o-transcribe-diarize。对于不需要说话人分离的通用转写,可根据最适合你用例的质量、成本和延迟权衡,使用 gpt-4o-transcribe、gpt-4o-mini-transcribe 或 whisper-1。在无法使用 OpenAI Direct 或 Azure OpenAI 集成的环境中,请使用 Whisper_large_v3。
关于各地理区域下按 enrollment 划分的可用性,请参见下文的 LLM 地理可用性表。
LLM 可用性前提
AIP 与模型无关,为 LLM 驱动的用例提供了多样化的模型选择;更多信息请参阅 AIP 中所有可用模型的列表。
不过,具体模型能否在某个 enrollment 上可用取决于某些前提条件,因此 LLM 的选择和可用性会因 enrollment 而异。这些前提条件决定了某个模型家族在 Control Panel 中显示为 enabled(已启用)、disabled(已禁用)还是 disallowed(不允许)。进一步了解模型启用界面中的模型状态。
相关标准如下:
- 模型已与 AIP 集成: Palantir 的目标是支持业界最新的旗舰模型,并会随着模型的发布和更新积极推进支持。
- 在需要时已完成法律确认: Enrollment 管理员必须接受提供商的法律要求和使用条款,才能启用某些模型。这通常可以在 Control Panel 的 Model enablement 选项卡中完成。等待法律确认的模型会显示为 disabled 状态。
- 已在 enrollment 上启用 AIP 以使用 LLM: 若要在 AIP Logic、Transforms、Functions 和 Pipeline Builder 等产品中使用,必须为目标用户组启用自定义工作流的 AIP 能力权限。
- 区域可用性兼容(针对外部提供商的模型): 对于 GPT、Claude 和 Gemini 这类模型,如果你的 enrollment 受地理限制,则可能需要考虑区域可用性。例如,GPT4o 和 Claude 3 Sonnet 在各自模型提供商发布时都仅在美国可用,之后才在欧盟、英国和其他地区推出。详情请查阅模型地理限制章节。因地理限制而不可用的模型会显示为 disallowed 状态。
- 已完成额外的审查(针对某些 Palantir 提供的模型): 开源模型(如 Llama 和 Mixtral)可能需要额外的 Palantir 工程审查以支持你的环境。需要此类审查的模型会显示为 disallowed 状态。
- 与特定 AIP 前端产品集成需要足够时间: 新的 LLM 需要一定时间才能在所有 AIP 产品上得到完整支持(例如在 AIP Logic 中以及 Pipeline Builder 的 Use LLM 节点功能中)。
- 风险考量(针对实验性模型): 由于实验性模型可能会失效或需要手动迁移到更新的模型,我们会限制其推广,客户可能需要在启用使用前予以确认。「experimental(实验性)」一词依模型提供商的描述而定,并非用于生产运营用途。
LLM 速率限制
关于 LLM 速率限制的信息,请查阅 LLM 容量管理文档。
LLM availability by geography
由于地理限制(简称 georestriction),某些 enrollment 可能只能访问有限的模型集合;某一区域的地理限制意味着发往 LLM 的任何 AIP 请求都保持在该区域边界内。例如,如果某个 enrollment 被定义为欧盟地理受限,则所有 LLM 请求都将在欧盟境内处理。未受地理限制的 enrollment 可以访问 Palantir 支持的全部模型。
下表列出了 AIP 所支持各模型可采用的地理限制区域选项。区域地理限制指的是 enrollment 的设置,而非特定用户所在的位置。
| Model Provider | Model | US | EU | UK | CA | AU | JP | KSA | IL2 | IL4 | IL5 |
|---|---|---|---|---|---|---|---|---|---|---|---|
| Anthropic | Claude Haiku 4.5 | ✅ | |||||||||
| Amazon Bedrock | Claude Haiku 4.5 | ✅ | ✅ | ✅ | ✅ | ||||||
| Azure | Claude Haiku 4.5 | ||||||||||
| Google Vertex | Claude Haiku 4.5 | ✅ | ✅ | ✅ | ✅ | ||||||
| Amazon Bedrock | Claude Opus 4.1 | ✅ | |||||||||
| Google Vertex | Claude Opus 4.1 | ✅ | ✅ | ||||||||
| Anthropic | Claude Opus 4.5 | ✅ | |||||||||
| Amazon Bedrock | Claude Opus 4.5 | ✅ | ✅ | ||||||||
| Azure | Claude Opus 4.5 | ||||||||||
| Google Vertex | Claude Opus 4.5 | ✅ | ✅ | ✅ | ✅ | ||||||
| Anthropic | Claude Opus 4.6 | ✅ | |||||||||
| Amazon Bedrock | Claude Opus 4.6 | ✅ | ✅ | ✅ | |||||||
| Azure | Claude Opus 4.6 | ||||||||||
| Google Vertex | Claude Opus 4.6 | ✅ | ✅ | ✅ | ✅ | ||||||
| Anthropic | Claude Opus 4.7 | ✅ | |||||||||
| Amazon Bedrock | Claude Opus 4.7 | ✅ | ✅ | ✅ | |||||||
| Azure | Claude Opus 4.7 | ||||||||||
| Google Vertex | Claude Opus 4.7 | ✅ | ✅ | ✅ | ✅ | ||||||
| Anthropic | Claude Opus 4.8 | ✅ | |||||||||
| Amazon Bedrock | Claude Opus 4.8 | ✅ | ✅ | ✅ | ✅ | ✅ | |||||
| Azure | Claude Opus 4.8 | ||||||||||
| Google Vertex | Claude Opus 4.8 | ✅ | ✅ | ✅ | ✅ | ||||||
| Anthropic | Claude Opus 5 | ✅ | |||||||||
| Amazon Bedrock | Claude Opus 5 | ✅ | ✅ | ✅ | |||||||
| Azure | Claude Opus 5 | ||||||||||
| Google Vertex | Claude Opus 5 | ✅ | ✅ | ✅ | ✅ | ||||||
| Google Vertex | Claude Sonnet 4 | ✅ | ✅ | ✅ | ✅ | ||||||
| Anthropic | Claude Sonnet 4.5 | ✅ | |||||||||
| Amazon Bedrock | Claude Sonnet 4.5 | ✅ | ✅ | ✅ | |||||||
| Azure | Claude Sonnet 4.5 | ||||||||||
| Google Vertex | Claude Sonnet 4.5 | ✅ | ✅ | ✅ | ✅ | ||||||
| Anthropic | Claude Sonnet 4.6 | ✅ | |||||||||
| Amazon Bedrock | Claude Sonnet 4.6 | ✅ | ✅ | ✅ | ✅ | ✅ | |||||
| Azure | Claude Sonnet 4.6 | ||||||||||
| Google Vertex | Claude Sonnet 4.6 | ✅ | ✅ | ✅ | ✅ | ||||||
| Anthropic | Claude Sonnet 5 | ✅ | |||||||||
| Amazon Bedrock | Claude Sonnet 5 | ✅ | ✅ | ✅ | |||||||
| Azure | Claude Sonnet 5 | ||||||||||
| Google Vertex | Claude Sonnet 5 | ✅ | ✅ | ✅ | ✅ | ||||||
| Google Vertex | Gemini 3 Flash (Preview) | ✅ | ✅ | ✅ | ✅ | ||||||
| Google Vertex | Gemini 3.1 Flash Lite | ✅ | ✅ | ✅ | ✅ | ✅ | |||||
| Google Vertex | Gemini 3.1 Pro (Preview) | ✅ | ✅ | ✅ | ✅ | ||||||
| Google Vertex | Gemini 3.5 Flash | ✅ | ✅ | ✅ | ✅ | ✅ | |||||
| Google Vertex | Gemini 3.5 Flash-Lite | ✅ | ✅ | ✅ | ✅ | ✅ | |||||
| Google Vertex | Gemini 3.6 Flash | ✅ | ✅ | ✅ | ✅ | ✅ | |||||
| Google Vertex | Gemini 3.7 Flash | ✅ | ✅ | ✅ | ✅ | ✅ | |||||
| Amazon Bedrock | Gemma 4 26B A4B | ✅ | ✅ | ||||||||
| Amazon Bedrock | Llama 3.1 8b Instruct | ✅ | |||||||||
| Palantir-hosted | Llama 3.1 8b Instruct | ||||||||||
| Amazon Bedrock | Llama 3.3 70b Instruct | ✅ | |||||||||
| Palantir-hosted | Llama 3.3 70b Instruct | ||||||||||
| Amazon Bedrock | Llama 4 Maverick 17b 128E Instruct | ✅ | |||||||||
| Amazon Bedrock | Llama 4 Scout 17b 16E Instruct | ✅ | |||||||||
| Palantir-hosted | Llama 4 Scout 17b 16E Instruct | ||||||||||
| Palantir-hosted | Llama 3.2 NV EmbedQA 1B v2 | ||||||||||
| Palantir-hosted | Llama 3.3 Nemotron Super 49b v1.5 | ||||||||||
| Amazon Bedrock | NVIDIA Nemotron 3 Nano 30B | ✅ | |||||||||
| Amazon Bedrock | NVIDIA Nemotron 3 Super 120B | ✅ | ✅ | ✅ | ✅ | ||||||
| Azure | GPT-4.1 | ✅ | ✅ | ✅ | ✅ | ✅ | |||||
| OpenAI | GPT-4.1 | ✅ | |||||||||
| Azure | GPT-4.1 mini | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | |
| OpenAI | GPT-4.1 mini | ✅ | |||||||||
| Azure | GPT-4.1 nano | ✅ | ✅ | ||||||||
| Azure | GPT-4o | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | |
| OpenAI | GPT-4o | ✅ | |||||||||
| Azure | GPT-5 | ✅ | ✅ | ||||||||
| Azure | GPT-5 Codex | ||||||||||
| Azure | GPT-5 mini | ✅ | ✅ | ||||||||
| Azure | GPT-5 nano | ✅ | ✅ | ||||||||
| Azure | GPT-5.1 | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | ||||
| OpenAI | GPT-5.1 | ✅ | |||||||||
| Azure | GPT-5.1 Codex | ||||||||||
| Azure | GPT-5.1 Codex mini | ||||||||||
| Azure | GPT-5.2 | ✅ | |||||||||
| OpenAI | GPT-5.2 | ✅ | |||||||||
| OpenAI | GPT-5.2 Pro | ✅ | |||||||||
| Azure | GPT-5.3 Codex | ✅ | |||||||||
| OpenAI | GPT-5.3 Codex | ||||||||||
| Azure | GPT-5.4 | ✅ | ✅ | ||||||||
| OpenAI | GPT-5.4 | ✅ | |||||||||
| OpenAI | GPT-5.4 Pro | ✅ | |||||||||
| Azure | GPT-5.4 mini | ✅ | |||||||||
| OpenAI | GPT-5.4 mini | ✅ | |||||||||
| Azure | GPT-5.4 nano | ✅ | |||||||||
| OpenAI | GPT-5.4 nano | ✅ | |||||||||
| Azure | GPT-5.5 | ✅ | ✅ | ||||||||
| OpenAI | GPT-5.5 | ✅ | |||||||||
| Azure | GPT-5.6 Luna | ✅ | ✅ | ||||||||
| OpenAI | GPT-5.6 Luna | ✅ | |||||||||
| Azure | GPT-5.6 Sol | ✅ | ✅ | ||||||||
| OpenAI | GPT-5.6 Sol | ✅ | |||||||||
| Azure | GPT-5.6 Terra | ✅ | ✅ | ||||||||
| OpenAI | GPT-5.6 Terra | ✅ | |||||||||
| Palantir-hosted | GPT-OSS-120B | ✅ | ✅ | ✅ | ✅ | ||||||
| Palantir-hosted | GPT-OSS-20B | ✅ | ✅ | ✅ | ✅ | ||||||
| Azure | Text Embedding 3 Large | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | |
| OpenAI | Text Embedding 3 Large | ✅ | |||||||||
| Azure | Text Embedding 3 Small | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | ||
| OpenAI | Text Embedding 3 Small | ✅ | |||||||||
| OpenAI | Whisper 1 | ✅ | |||||||||
| Azure | o1 | ✅ | ✅ | ||||||||
| Azure | o3 | ✅ | ✅ | ||||||||
| Azure | o3-mini | ✅ | ✅ | ✅ | ✅ | ✅ | |||||
| Azure | o4-mini | ✅ | ✅ | ||||||||
| Azure | text-embedding-ada-002 | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | |
| OpenAI | text-embedding-ada-002 | ✅ | |||||||||
| Palantir-hosted | Document Information Extraction | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | |
| Palantir-hosted | Gemma 4 26B A4B | ✅ | ✅ | ✅ | ✅ | ||||||
| Palantir-hosted | Schematic 7B | ✅ | ✅ | ✅ | |||||||
| Palantir-hosted | Whisper Large V3 | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ | |
| Palantir-hosted | Snowflake Arctic Embed Medium | ||||||||||
| xAI | Grok 4.3 | ✅ | |||||||||
| xAI | Grok 4.5 | ✅ | |||||||||
| xAI | Grok 420 Non-Reasoning Latest | ✅ | |||||||||
| xAI | Grok 420 Reasoning Latest | ✅ | |||||||||
| xAI | Grok Build 0.1 | ✅ |
自带模型(LLM)
自带模型(Bring your own model)是一项能力,为希望连接自己的 LLM 或账号、以便在 AIP 中与所有 Palantir 开发者产品(AIP Logic、Pipeline Builder、Chatbot Studio、Workshop 等)一起使用的客户提供一等支持。
请查阅自带模型文档,了解如何注册模型以便在 AIP 中使用。
注意:AIP 功能的可用性可能会发生变化,且可能因客户而异。
「OpenAI」名称与「GPT」品牌归 OpenAI 所有。
本文提及的所有第三方商标(包括徽标和图标)均归其各自所有者所有。不暗示任何关联或背书关系。
延伸阅读 · 相关页面
按主题横向跳转,不必顺着目录一篇篇读。
本组其他页面 · 核心平台(AIP 总览与治理)
同一主题下的相邻内容。
- AIP 总览:把 AI 接进你的数据与运营AIP(Artificial Intelligence Platform)不是孤立的模型平台,它长在你的数据与 Onto
- AIP 能力清单:平台各处的 AI 特性平台里几乎每个应用都配备了 AIP 驱动能力。这一篇把它们按应用分类列全,作为你的能力索引表。
- 开始使用 AIP:学习路径这一篇很短,只回答一个问题:该按什么顺序学 AIP。
- 提示词工程最佳实践写提示词(prompt)这件事,直接决定 LLM 输出的质量。这一篇讲怎么写出稳定可靠的提示词,是所有 AI 应用的基本
- 兼容各提供商的原生 API 端点Foundry 为主流 LLM 提供商提供代理端点,按各提供商原生 API 的格式接收请求 —— 你可以继续用熟悉的开源
- AI 伦理与治理Palantir 把负责任 AI 当作构建方式本身,而不是事后补丁。这一篇讲他们的伦理原则与治理机制。
- AIP 的安全与隐私把 AI 接进企业数据,安全是第一道门槛。这一篇讲 AIP 如何保护客户数据的隐私与安全。
- AIP 的计算用量与计费LLM 按 token 计费:输入文本和输出文本都要算钱。这一篇讲清用量从哪来、怎么算、怎么控。
- Ontology 与 AIP 的可观测性AI 跑出问题了,怎么查?这一篇讲 Workflow Lineage 里的一组能力,让你看清每条 AI 流程的来龙去脉。
- 管理员:开启 AIP 能力AIP 能力默认可能并未全部开启。这一篇是管理员的操作指南:在哪些界面、按什么顺序把能力开出来。
- 管理员:LLM 容量管理LLM 容量在行业层面是有限资源,所有提供商都会限制账户的最大可用容量。这一篇讲 AIP 如何在组织内分配这份稀缺资源。
- 管理员:LLM 注册速率限制这一篇是纯数值参照表:各注册层级在商业环境与政府环境下的 TPM(每分钟 token 数)与 RPM(每分钟请求数)上限
常见问题速答 · FAQ
关于「平台支持的 LLM 清单」,读者最常问的几个问题。