Modelos disponibles en Unity Gateway

Databricks alberga los últimos modelos de socios y de peso abierto. Utiliza Unity Gateway para acceder a estos modelos de aplicaciones, agentes de codificación y cargas de trabajo de IA sobre tus datos.

Empieza a enviar consultas a modelos.

Modelos disponibles a través de Databricks

Los siguientes modelos están alojados por Databricks. Cada nombre de modelo enlaza con sus especificaciones.

Los activos de modelo en system.ai se listan globalmente. Ver un modelo allí no significa que esté disponible en tu espacio de trabajo. La disponibilidad depende de la región de tu espacio de trabajo, la configuración entre regiones geográficas y la disponibilidad de los modelos. Consulta la interfaz de Unity Gateway para el servicio de modelos correspondiente y confirma que tienes permiso para consultarlo.

Incluir un modelo no le envía datos de los clientes para realizar inferencias. Consulte la disponibilidad de modelos por región para detalles regionales.

Nota

En Azure Databricks, OpenAI y Google Gemini modelos, junto con Zhipu AI GLM 5.3, GLM 5.3 Flash y GLM 5.2, Moonshot AI Kimi K3, Thinking Machine Labs Inkling y DeepSeek V4.1 Flash y V4 Flash, están disponibles a través de ADI Services, proporcionados por Databricks. Para estas descripciones de modelos, véase Lista detallada de modelos soportados por las APIs de modelos de la Fundación Databricks. Para configuración y acceso, consulta Servicios ADI.

Provider Familia de modelos Models
Anthropic Claude Haiku Claude Haiku 4.5
Anthropic Claude Sonnet Claude Sonnet 5.5, Claude Sonnet 5, Claude Sonnet 4.6, Claude Sonnet 4.5
Anthropic Claude Fable Claude Fable 5.1, Claude Fable 5
Anthropic Claude Opus Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7, Claude Opus 4.6, Claude Opus 4.5, Claude Opus 4.1
OpenAI GPT (en inglés) GPT-6 Astra, GPT-5.6 Sol, GPT-5.6 Terra, GPT-5.6 Luna, GPT-5.5 Pro, GPT-5.5, GPT-5.4, GPT-5.4 mini, GPT-5.4 nano, GPT-5.2, GPT-5.1, GPT-5, GPT-5 mini, GPT-5 nano
OpenAI Códice GPT Códice GPT-5.3
OpenAI GPT OSS GPT OSS 120B, GPT OSS 20B
Google Gemini Flash Gemini 3.6 Flash, Gemini 3.5 Flash, Gemini 3.5 Flash Lite, Gemini 3.1 Flash Lite, Gemini 3 Flash
Google Gemini Pro Vista previa de Gemini 3.1 Pro
Google Generación de imágenes de Géminis Gemini 3.1 Flash Imagen, Gemini 3 Pro Imagen
Google Gemma Gemma 3 12B
Meta Llama Llama 4 Maverick, Llama 3.3 70B Instruct, Llama 3.1 8B Instruct
Alibaba Cloud Qwen Qwen3.5 122B A10B, Qwen3-Embedding-0.6B, Qwen3-Next 80B A3B Instruct
Inteligencia Artificial Moonshot Kimi Kimi K3
Zhipu AI GLM GLM 5.3, GLM 5.3 Flash, GLM 5.2
DeepSeek DeepSeek V4.1 Flash, V4 Flash (0731)
Laboratorios de Máquinas Pensantes Inkling Inkling
Alibaba GTE GTE Large (En)

Para modelos obsoletos y reemplazos recomendados, véase Modelos obsoletos y retirados.

Usa un modelo

Tu tarea Cómo usar los modelos
Crea una aplicación o agente Llama a un modelo a través de la API de Unity Gateway. Los servicios system.aide modelo proporcionados por el sistema te permiten empezar sin crear un servicio de modelo personalizado. Consulta Modelos de consulta.
Aplica IA a tus datos Usa ai_query para enviar prompts a un modelo compatible desde SQL, notebooks o canalizaciones por lotes. Véase Uso de ai_query.
Uso de un agente de codificación Conecta tu agente de codificación a los modelos a través de Unity Gateway. Consulta Agentes de codificación soportados.

Los modelos compatibles y los identificadores de modelos varían según la interfaz. Consulta las guías enlazadas para requisitos y ejemplos.

Servicios modelo proporcionados por el sistema

Azure Databricks proporciona servicios de modelos listos para usar y de pago por token en system.ai, como system.ai.claude-opus-5. Se añaden nuevos servicios a medida que existen modelos de fundación.

  • Un usuario del sistema los posee y no puede eliminarlos.
  • De forma predeterminada, solo los administradores de metastore pueden modificarlos. Un administrador de metastore puede delegar la administración concediéndole el MANAGE privilegio.

Para restringir el acceso, consulte Descubrir y regular el acceso a servicios modelo.

Elige capacidad de servicio

Option Recomendado para Cómo funciona
Pago por token Cargas de trabajo con uso variable o intermitente. Paga por los tokens que uses sin aprovisionar capacidad de servicio dedicada.
Rendimiento provisionado bajo demanda Cargas de trabajo que requieren capacidad dedicada con flexibilidad para ajustarla según cambien los requisitos. Paga por la capacidad asignada sin compromiso de plazo.

Los servicios del modelo Unity Gateway pueden enrutar a destinos de rendimiento provisionado. Consulta la documentación de cada opción para modelos elegibles y requisitos de configuración.

Para inferencia por lotes con ai_query, utiliza la guía de Funciones de IA para seleccionar los modelos compatibles y las opciones de servicio. El modelo y el apoyo regional varían según la opción de servicio.

Conecta con otros proveedores modelo

También puedes usar Unity Gateway con tu propia cuenta de proveedor modelo. Conecta con el proveedor modelo y regula el acceso usando las credenciales de tu organización.

Consulta Conectar un proveedor de modelos externo.

Información relacionada