Disponibilidad de modelos por región

Consulta las tablas para ver el apoyo modelo y modelo a la familia en cada región y opción de servicio. Para navegar por modelos por proveedor, consulta los modelos disponibles en Unity Gateway.

Las tablas describen el soporte de modelos. Para consultar un modelo a través de Unity Gateway, comprueba el servicio de modelo correspondiente en tu espacio de trabajo. La disponibilidad depende de la región, de los entornos entre geometrías y de la capacidad de servicio disponible. Los permisos necesarios siguen aplicándose.

Modelos de Foundation hospedados en Databricks

Databricks hospeda modelos de base abiertos de última generación. Estos modelos están disponibles mediante las API de Foundation Model. Para restringir los modelos de base hospedados en Databricks que su organización puede usar, consulte permisos del catálogo de Unity del modelo de base.

Note

En Azure Databricks, OpenAI y modelos Google Gemini, junto con Zhipu AI GLM 5.3, GLM 5.3 Flash y GLM 5.2 (legacy), Moonshot AI Kimi K3, Thinking Machine Labs Inkling, DeepSeek V4.1 Flash y V4 Flash, y OpenJev (Qwen3.5 4B) están disponibles a través de los servicios ADI, proporcionados por Databricks. Para estas descripciones de modelos, véase Lista detallada de modelos soportados por las APIs de modelos de la Fundación Databricks. Para configuración y acceso, consulta Servicios ADI.

En la tabla siguiente se resumen las familias de modelos y modelos hospedadas en Databricks que se admiten en cada región en función de la característica Servicio de modelos.

Importante

  • Anthropic Claude Sonnet 4 ha quedado obsoleto. Consulte Modelos en desuso y retirados para su fecha de retirada, modelo de reemplazo recomendado e instrucciones sobre cómo migrar durante el desuso.
  • DeepSeek V4 Flash (0731) está obsoleto y está previsto su retiro el 5 de noviembre de 2026. Consulte Modelos en desuso y retirados para ver el modelo de reemplazo recomendado e instrucciones sobre cómo migrar durante el desuso.
  • Anthropic Claude 3.7 Sonnet ya no está disponible. Consulte Modelos en desuso y retirados para ver el modelo de reemplazo recomendado e instrucciones sobre cómo migrar durante el desuso.
  • Meta Llama 4 Maverick está disponible para las cargas de trabajo de rendimiento aprovisionadas de Foundation Model en versión preliminar pública.
  • Meta-Llama-3.1-405B-Instruct ya no está disponible para cargas de trabajo de pago por token ni de rendimiento provisionado. Consulte Modelos en desuso y retirados para ver el modelo de reemplazo recomendado e instrucciones sobre cómo migrar durante el desuso.
  • Se han retirado varias familias de modelos antiguos. Consulte Modelos en desuso y retirados para obtener la lista completa de modelos retirados y reemplazos recomendados.
Region Pago por token de API de Foundation Model Funciones de IA (inferencia por lotes) Rendimiento aprovisionado de API de Foundation Model
australiacentral No soportado No soportado No soportado
australiacentral2 No soportado No soportado No soportado
australiaeast Los modelos admitidos son los siguientes:
Los modelos admitidos son los siguientes:
  • Se admiten las siguientes familias de modelos para la inferencia en tiempo real:
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B
    • Busca en Google Gemma 3 12B
    • Meta Llama 4 Maverick (versión preliminar)⥂
    • Meta Llama 3.3
    • Meta Llama 3.2 3B
    • Meta Llama 3.2 1B
    • Meta Llama 3.1
    • GTE v1.5 (inglés)
    • BGE v1.5 (inglés)
australiasoutheast No soportado No soportado No soportado
brazilsouth Los modelos admitidos son los siguientes:
Los modelos admitidos son los siguientes:
  • Se admiten las siguientes familias de modelos para la inferencia en tiempo real:
    • OpenAI GPT OSS 120B⥂
    • OpenAI GPT OSS 20B⥂
    • Busca en Google Gemma 3 12B⥂
    • Meta Llama 4 Maverick⥂ (versión preliminar)
    • Meta Llama 3.3⥂
    • Meta Llama 3.2 3B⥂
    • Meta Llama 3.2 1B⥂
    • Meta Llama 3.1⥂
    • GTE v1.5 (inglés)⥂
    • BGE v1.5 (inglés)⥂
canadacentral Los modelos admitidos son los siguientes:
Los modelos admitidos son los siguientes:
  • Se admiten las siguientes familias de modelos para la inferencia en tiempo real:
    • OpenAI GPT OSS 120B⥂
    • OpenAI GPT OSS 20B⥂
    • Busca en Google Gemma 3 12B⥂
    • Meta Llama 4 Maverick⥂ (versión preliminar)
    • Meta Llama 3.3⥂
    • Meta Llama 3.2 3B⥂
    • Meta Llama 3.2 1B⥂
    • Meta Llama 3.1⥂
    • GTE v1.5 (inglés)⥂
    • BGE v1.5 (inglés)⥂
canadaeast No soportado No soportado No soportado
centralindia Los modelos admitidos son los siguientes:
Los modelos admitidos son los siguientes:
  • Se admiten las siguientes familias de modelos para la inferencia en tiempo real:
    • OpenAI GPT OSS 120B⥂
    • OpenAI GPT OSS 20B⥂
    • Busca en Google Gemma 3 12B⥂
    • Meta Llama 4 Maverick⥂ (versión preliminar)
    • Meta Llama 3.3⥂
    • Meta Llama 3.2 3B⥂
    • Meta Llama 3.2 1B⥂
    • Meta Llama 3.1⥂
    • GTE v1.5 (inglés)⥂
    • BGE v1.5 (inglés)⥂
centralus Los modelos admitidos son los siguientes:
Los modelos admitidos son los siguientes:
  • Se admiten las siguientes familias de modelos para la inferencia en tiempo real:
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B
    • Busca en Google Gemma 3 12B
    • Meta Llama 4 Maverick (versión preliminar)
    • Meta Llama 3.3
    • Meta Llama 3.2 3B
    • Meta Llama 3.2 1B
    • Meta Llama 3.1
    • GTE v1.5 (inglés)
    • BGE v1.5 (inglés)
chinaeast2 No soportado No soportado No soportado
chinaeast3 No soportado No soportado No soportado
chinanorth2 No soportado No soportado No soportado
chinanorth3 No soportado No soportado No soportado
eastasia Los modelos admitidos son los siguientes:
Los modelos admitidos son los siguientes:
  • Se admiten las siguientes familias de modelos para la inferencia en tiempo real:
    • OpenAI GPT OSS 120B⥂
    • OpenAI GPT OSS 20B⥂
    • Busca en Google Gemma 3 12B⥂
    • Meta Llama 4 Maverick⥂ (versión preliminar)
    • Meta Llama 3.3⥂
    • Meta Llama 3.2 3B⥂
    • Meta Llama 3.2 1B⥂
    • Meta Llama 3.1⥂
    • GTE v1.5 (inglés)⥂
    • BGE v1.5 (inglés)⥂
eastus Los modelos admitidos son los siguientes:
Los modelos admitidos son los siguientes:
  • Se admiten las siguientes familias de modelos para la inferencia en tiempo real:
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B
    • Busca en Google Gemma 3 12B
    • Meta Llama 4 Maverick (versión preliminar)
    • Meta Llama 3.3
    • Meta Llama 3.2 3B
    • Meta Llama 3.2 1B
    • Meta Llama 3.1
    • GTE v1.5 (inglés)
    • BGE v1.5 (inglés)
eastus2 Los modelos admitidos son los siguientes:
Los modelos admitidos son los siguientes:
  • Se admiten las siguientes familias de modelos para la inferencia en tiempo real:
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B
    • Busca en Google Gemma 3 12B
    • Alibaba Cloud Qwen3.5 122B A10B (versión preliminar)
    • Meta Llama 4 Maverick (versión preliminar)
    • Meta Llama 3.3
    • Meta Llama 3.2 3B
    • Meta Llama 3.2 1B
    • Meta Llama 3.1
    • GTE v1.5 (inglés)
    • BGE v1.5 (inglés)
francecentral Los modelos admitidos son los siguientes:
Los modelos admitidos son los siguientes:
  • Se admiten las siguientes familias de modelos para la inferencia en tiempo real:
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B
    • Busca en Google Gemma 3 12B
    • Meta Llama 4 Maverick (versión preliminar)
    • Meta Llama 3.3
    • Meta Llama 3.2 3B
    • Meta Llama 3.2 1B
    • Meta Llama 3.1
    • GTE v1.5 (inglés)
    • BGE v1.5 (inglés)
germanywestcentral Los modelos admitidos son los siguientes:
Los modelos admitidos son los siguientes:
  • Se admiten las siguientes familias de modelos para la inferencia en tiempo real:
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B
    • Busca en Google Gemma 3 12B
    • Meta Llama 4 Maverick (versión preliminar)
    • Meta Llama 3.3
    • Meta Llama 3.2 3B
    • Meta Llama 3.2 1B
    • Meta Llama 3.1
    • GTE v1.5 (inglés)
    • BGE v1.5 (inglés)
japaneast Los modelos admitidos son los siguientes:
Los modelos admitidos son los siguientes:
  • Se admiten las siguientes familias de modelos para la inferencia en tiempo real:
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B⥂
    • Busca en Google Gemma 3 12B
    • Alibaba Cloud Qwen3.5 122B A10B (versión preliminar)
    • Meta Llama 4 Maverick⥂ (versión preliminar)
    • Meta Llama 3.3⥂
    • Meta Llama 3.2 3B⥂
    • Meta Llama 3.2 1B⥂
    • Meta Llama 3.1⥂
    • GTE v1.5 (inglés)⥂
    • BGE v1.5 (inglés)⥂
japanwest No soportado No soportado No soportado
koreacentral Los modelos admitidos son los siguientes:
Los modelos admitidos son los siguientes:
  • Se admiten las siguientes familias de modelos para la inferencia en tiempo real:
    • OpenAI GPT OSS 120B⥂
    • OpenAI GPT OSS 20B⥂
    • Busca en Google Gemma 3 12B⥂
    • Meta Llama 4 Maverick⥂
    • Meta Llama 3.3⥂
    • Meta Llama 3.2 3B⥂
    • Meta Llama 3.2 1B⥂
    • Meta Llama 3.1⥂
mexicocentral No soportado No soportado No soportado
northcentralus Los modelos admitidos son los siguientes:
Los modelos admitidos son los siguientes:
  • Se admiten las siguientes familias de modelos para la inferencia en tiempo real:
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B
    • Busca en Google Gemma 3 12B
    • Meta Llama 4 Maverick (versión preliminar)
    • Meta Llama 3.3
    • Meta Llama 3.2 3B
    • Meta Llama 3.2 1B
    • Meta Llama 3.1
    • GTE v1.5 (inglés)
    • BGE v1.5 (inglés)
northeurope Los modelos admitidos son los siguientes:
Los modelos admitidos son los siguientes:
  • Se admiten las siguientes familias de modelos para la inferencia en tiempo real:
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B
    • Busca en Google Gemma 3 12B
    • Meta Llama 4 Maverick (versión preliminar)
    • Meta Llama 3.3
    • Meta Llama 3.2 3B
    • Meta Llama 3.2 1B
    • Meta Llama 3.1
    • GTE v1.5 (inglés)
    • BGE v1.5 (inglés)
norwayeast No soportado No soportado No soportado
qatarcentral No soportado No soportado No soportado
southafricanorth No soportado No soportado No soportado
southcentralus Los modelos admitidos son los siguientes:
Los modelos admitidos son los siguientes:
  • Se admiten las siguientes familias de modelos para la inferencia en tiempo real:
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B
    • Busca en Google Gemma 3 12B
    • Meta Llama 4 Maverick (versión preliminar)
    • Meta Llama 3.3
    • Meta Llama 3.2 3B
    • Meta Llama 3.2 1B
    • Meta Llama 3.1
    • GTE v1.5 (inglés)
    • BGE v1.5 (inglés)
southeastasia Los modelos admitidos son los siguientes:
Los modelos admitidos son los siguientes:
  • Se admiten las siguientes familias de modelos para la inferencia en tiempo real:
    • OpenAI GPT OSS 120B⥂
    • OpenAI GPT OSS 20B⥂
    • Busca en Google Gemma 3 12B⥂
    • Meta Llama 4 Maverick⥂ (versión preliminar)
    • Meta Llama 3.3⥂
    • Meta Llama 3.2 3B⥂
    • Meta Llama 3.2 1B⥂
    • Meta Llama 3.1⥂
    • GTE v1.5 (inglés)⥂
    • BGE v1.5 (inglés)⥂
southindia No soportado No soportado No soportado
swedencentral Los modelos admitidos son los siguientes:
Los modelos admitidos son los siguientes:
  • Se admiten las siguientes familias de modelos para la inferencia en tiempo real:
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B
    • Busca en Google Gemma 3 12B
    • Meta Llama 4 Maverick (versión preliminar)
    • Meta Llama 3.3
    • Meta Llama 3.2 3B
    • Meta Llama 3.2 1B
    • Meta Llama 3.1
    • GTE v1.5 (inglés)
    • BGE v1.5 (inglés)
switzerlandnorth Los modelos admitidos son los siguientes:
Los modelos admitidos son los siguientes:
  • Se admiten las siguientes familias de modelos para la inferencia en tiempo real:
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B
    • Busca en Google Gemma 3 12B
    • Meta Llama 4 Maverick (versión preliminar)
    • Meta Llama 3.3
    • Meta Llama 3.2 3B
    • Meta Llama 3.2 1B
    • Meta Llama 3.1
    • GTE v1.5 (inglés)
    • BGE v1.5 (inglés)
switzerlandwest No soportado No soportado No soportado
uaenorth Los modelos admitidos son los siguientes:
Los modelos admitidos son los siguientes:
  • Se admiten las siguientes familias de modelos para la inferencia en tiempo real:
    • OpenAI GPT OSS 120B⥂
    • OpenAI GPT OSS 20B⥂
    • Busca en Google Gemma 3 12B⥂
    • Meta Llama 4 Maverick⥂ (versión preliminar)
    • Meta Llama 3.3⥂
    • Meta Llama 3.2 3B⥂
    • Meta Llama 3.2 1B⥂
    • Meta Llama 3.1⥂
    • GTE v1.5 (inglés)⥂
    • BGE v1.5 (inglés)⥂
uksouth Los modelos admitidos son los siguientes:
Los modelos admitidos son los siguientes:
  • Se admiten las siguientes familias de modelos para la inferencia en tiempo real:
    • OpenAI GPT OSS 120B⥂
    • OpenAI GPT OSS 20B⥂
    • Busca en Google Gemma 3 12B⥂
    • Meta Llama 4 Maverick⥂ (versión preliminar)
    • Meta Llama 3.3⥂
    • Meta Llama 3.2 3B⥂
    • Meta Llama 3.2 1B⥂
    • Meta Llama 3.1⥂
    • GTE v1.5 (inglés)⥂
    • BGE v1.5 (inglés)⥂
ukwest No soportado No soportado No soportado
westcentralus No soportado No soportado No soportado
westeurope Los modelos admitidos son los siguientes:
Los modelos admitidos son los siguientes:
  • Se admiten las siguientes familias de modelos para la inferencia en tiempo real:
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B
    • Busca en Google Gemma 3 12B
    • Meta Llama 4 Maverick (versión preliminar)
    • Meta Llama 3.3
    • Meta Llama 3.2 3B
    • Meta Llama 3.2 1B
    • Meta Llama 3.1
    • GTE v1.5 (inglés)
    • BGE v1.5 (inglés)
westindia No soportado No soportado No soportado
westus Los modelos admitidos son los siguientes:
Los modelos admitidos son los siguientes:
  • Se admiten las siguientes familias de modelos para la inferencia en tiempo real:
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B
    • Busca en Google Gemma 3 12B
    • Alibaba Cloud Qwen3.5 122B A10B (versión preliminar)
    • Meta Llama 4 Maverick (versión preliminar)
    • Meta Llama 3.3
    • Meta Llama 3.2 3B
    • Meta Llama 3.2 1B
    • Meta Llama 3.1
    • GTE v1.5 (inglés)
    • BGE v1.5 (inglés)
westus2 Los modelos admitidos son los siguientes:
Los modelos admitidos son los siguientes:
  • Se admiten las siguientes familias de modelos para la inferencia en tiempo real:
    • OpenAI GPT OSS 120B
    • OpenAI GPT OSS 20B
    • Busca en Google Gemma 3 12B
    • Meta Llama 4 Maverick (versión preliminar)
    • Meta Llama 3.3
    • Meta Llama 3.2 3B
    • Meta Llama 3.2 1B
    • Meta Llama 3.1
    • GTE v1.5 (inglés)
    • BGE v1.5 (inglés)
westus3 Los modelos admitidos son los siguientes:
No soportado No soportado

† El acceso está disponible a través de ADI Services, ofrecido por Databricks.

⥂ Este modelo se admite en función de la disponibilidad de GPU y requiere que se habilite el enrutamiento entre zonas geográficas.