Groq — сверхбыстрый inference LLM на LPU Groq: низкая задержка генерации токенов. AI inference.
Возможности:
- Очень быстрый inference больших моделей
- API для latency-критичных приложений
- Разработчикам — скорость ответа
- Инфраструктура генерации нового класса
Попробовать
Отзывы








