Selección del editor
Groq
Inferencia extremadamente rápida para modelos abiertos.
Qué es
Usa hardware propio (LPU) para generar tokens a una velocidad muy superior a la de una GPU tradicional. Sirve modelos abiertos populares mediante una API compatible con OpenAI, lo que hace trivial migrar código existente.
Ideal para
Interfaces de chat donde la latencia se nota.
Qué incluye el plan gratuito
- Límites de peticiones y tokens por minuto y día
- API compatible con el SDK de OpenAI
- Catálogo centrado en modelos abiertos
Los planes gratuitos cambian con frecuencia. Confirma los límites en la página oficial antes de tomar una decisión.
Hugging Face
SelecciónModelos, datasets y demos ejecutables de la comunidad.
Gratis para modelos, datasets y Spaces públicos
Google AI Studio
SelecciónPrototipa con los modelos Gemini desde el navegador.
Uso del estudio gratuito y nivel gratuito de la API
NVIDIA NIM
APIs alojadas para modelos de IA optimizados por NVIDIA.
Créditos de API gratuitos para prototipar