Cómo acceder a los modelos de OpenAI en Amazon Bedrock desde Australia y qué implica para equipos en LatAm
Amazon Bedrock ahora permite que equipos en Australia invoquen los modelos OpenAI GPT-5.6 (Sol, Terra y Luna) desde las regiones de Sydney y Melbourne con inferencia global. Esto facilita acceso a mayor capacidad sin que las aplicaciones gestionen el ruteo entre regiones.
Resumen de la novedad
Amazon Bedrock amplió el acceso a los modelos comerciales de OpenAI —GPT-5.6 Sol, Terra y Luna— desde las regiones de AWS en Australia: Asia Pacific (Sydney) y Asia Pacific (Melbourne). Aunque su aplicación llama al endpoint regional de Bedrock en Sydney (ap-southeast-2) o Melbourne (ap-southeast-4), Bedrock puede enrutar la petición a regiones comerciales compatibles para su procesamiento (cross-Region inference). El objetivo es ofrecer mayor capacidad disponible sin que las aplicaciones deban administrar el ruteo hacia la región destino.
Para equipos en América Latina que trabajan con clientes o cargas en la región APAC, o que tienen arquitecturas distribuidas, esta funcionalidad simplifica la integración con los modelos OpenAI y amplía las opciones de despliegue.
Qué ofrecen los modelos GPT-5.6 disponibles
Los tres perfiles globales disponibles son:
- GPT-5.6 Sol: diseñado para tareas exigentes de razonamiento, codificación y workloads agenticos.
- GPT-5.6 Terra: busca un equilibrio entre rendimiento y costo para uso de producción diario.
- GPT-5.6 Luna: optimizado para inferencia rápida y económica en aplicaciones de alto volumen y sensibilidad a latencia.
Puntos técnicos comunes a los tres modelos, según la documentación de Bedrock:
- Aceptan entradas de texto e imagen.
- Generan texto como salida.
- Soportan ventanas de contexto de hasta 1 millón de tokens.
Cómo funciona la inferencia cross-Region (a grandes rasgos)
Cuando su aplicación invoca el endpoint de Amazon Bedrock en Sydney o Melbourne, Bedrock gestiona internamente el enrutamiento hacia una región comercial donde haya capacidad para ejecutar el modelo solicitado. Esto significa:
- Acceso a un pool de capacidad más amplio.
- No es necesario que su aplicación mantenga lógica para decidir a qué región enviar la petición.
Importante: la pertenencia a perfiles y la disponibilidad de modelos pueden cambiar. Antes de desplegar en producción, verifique el estado de compatibilidad de Cross-Region inference en la documentación oficial.
Requisitos previos y consideraciones operativas
Antes de probar los perfiles GPT-5.6 desde Australia, confirme lo siguiente:
- Cuenta AWS con la región Asia Pacific (Sydney) o Asia Pacific (Melbourne) habilitada como source Region.
- Si su organización utiliza Service Control Policies (SCP), compruebe que permitan los perfiles globales GPT-5.6 en la región source seleccionada.
- Un rol o usuario IAM con permisos adecuados para invocar los perfiles de inferencia GPT-5.6.
- Entorno local o servidor con Python 3.9+ y las librerías: openai, boto3 y aws-bedrock-token-generator instaladas.
Estos puntos también aplican si su equipo en Latinoamérica coordina con equipos en Australia o gestiona cuentas y controles centralizados.
Verificar los perfiles globales activos
Puede comprobar qué perfiles de inferencia GPT-5.6 están activos usando la AWS CLI o la consola de Amazon Bedrock.
Ejemplo con AWS CLI (desde Sydney):
aws bedrock list-inference-profiles \
--region ap-southeast-2 \
--type-equals SYSTEM_DEFINED \
--query "inferenceProfileSummaries[?contains(inferenceProfileId, 'openai.gpt-5.6')].[inferenceProfileId,status]" \
--output table
aws bedrock get-inference-profile \
--region ap-southeast-2 \
--inference-profile-identifier global.openai.gpt-5.6-terra
Para verificar desde Melbourne, reemplace ap-southeast-2 por ap-southeast-4 y puede inspeccionar los perfiles global.openai.gpt-5.6-sol o global.openai.gpt-5.6-luna según su interés.
También puede abrir la consola de Amazon Bedrock, seleccionar Sydney o Melbourne como su región y en Infer > Inference profiles filtrar por “Global OpenAI GPT-5.6 Terra” (u otro perfil) para ver su estado.
Invocar los modelos a través del endpoint Bedrock Runtime
Amazon Bedrock expone compatibilidad con APIs OpenAI y con su propia API Converse. Los caminos OpenAI se exponen en la ruta /openai/v1 del endpoint regional. Las opciones de autenticación soportadas son AWS Signature Version 4 (SigV4) o una Bedrock model inference API key.
Para evitar almacenar claves estáticas, Bedrock proporciona un mecanismo para generar claves temporales. A continuación se muestra un ejemplo en Python que usa el generador de tokens de Bedrock para crear una clave de corto plazo y luego llama a la Responses API (compatible con el SDK de OpenAI):
from aws_bedrock_token_generator import provide_token
from openai import OpenAI
region = "ap-southeast-2" # use "ap-southeast-4" para Melbourne
model_id = "global.openai.gpt-5.6-terra"
prompt = (
"En tres viñetas, explique cómo las Availability Zones "
"ayudan a hacer una aplicación AWS altamente disponible."
)
openai_client = OpenAI(
base_url=f"https://bedrock-runtime.{region}.amazonaws.com/openai/v1",
api_key=provide_token(region=region),
)
responses_result = openai_client.responses.create(
model=model_id,
input=prompt,
max_output_tokens=300,
)
print(responses_result.output_text)
Si desea salida en streaming, configure stream=True y procese los eventos a medida que llegan (el ejemplo original muestra cómo iterar los eventos para imprimir texto parcial).
También puede usar la Chat Completions API de OpenAI sobre el mismo endpoint cambiando el método del cliente al apropiado para esa API.
Buenas prácticas operativas y de costo
En el lanzamiento se sugiere considerar las siguientes prácticas (la publicación original las menciona como puntos clave):
- Uso de prompt caching para optimizar costos de inferencia cuando se repiten prompts o se pueden reutilizar respuestas.
- Configurar Codex con autenticación basada en OpenID Connect (OIDC) para flujos de identidad más seguros cuando sea aplicable.
- Monitorizar uso y rendimiento con Amazon CloudWatch y con Coding Agent Insights para identificar patrones de consumo, latencia y errores.
Además, valide las políticas de control de servicio (SCP) y los permisos IAM antes de la adopción para evitar bloqueos de acceso en entornos corporativos.
Conclusión y próximos pasos
La disponibilidad de GPT-5.6 Sol, Terra y Luna a través de Amazon Bedrock desde Sydney y Melbourne facilita a equipos que operan en Australia (y a equipos globales con presencia en APAC) acceder a modelos OpenAI sin que sus aplicaciones gestionen ruteo entre regiones. Para equipos en Latinoamérica esto puede ser relevante si coordinan despliegues con APAC o evalúan arquitecturas multi-región.
Antes de moverse a producción, confirme la disponibilidad del perfil que necesita, ajuste políticas de seguridad (SCP/IAM) y considere optimizaciones como prompt caching y monitoreo con CloudWatch. Consulte la documentación oficial de Amazon Bedrock para detalles actualizados sobre soporte cross-Region y cambios en la disponibilidad de perfiles.
Fuente original: AWS ML Blog