top of page
IG.png

NVIDIA inicia la producción a gran escala de los chips aceleradores de inferencia de IA Groq 3 LPX, potenciando al máximo a Vera Rubin con las velocidades de generación de tokens más rápidas

  • Foto del escritor: Masterbitz
    Masterbitz
  • hace 45 minutos
  • 3 min de lectura

El Groq 3 LPX de NVIDIA está ahora en plena producción, ofreciendo grandes aceleraciones de generación de tokens para las plataformas Vera Rubin en el espacio de la IA de Agtic.



NVIDIA Marca Las Capacidades De Generación De Tokens Vera Rubin NVL72, Grabando 3.400 TPS Con Aceleradores De Inferencia De IA Groq 3 LPX

Como parte de sus anuncios de Hot Chips 2026, NVIDIA anunció hoy que su chip acelerador de inferencia de IA Groq 3 LPX está en plena producción. Este anuncio sigue a los anuncios de producción en masa de las CPU de Vera y los servidores de Vera Rubin, marcando la sólida ejecución de la hoja de ruta de inteligencia artificial de NVIDIA.



Los racks Groq 3 LPX sirven como una extensión de la plataforma NVIDIA Vera Rubin, ofreciendo capacidades de inferencia de IA impulsadas que permiten la generación de tokens ultrarrápidos para cargas de trabajo agentes sensibles a la respuesta, ya que estos sistemas pueden generar una gran cantidad de tokens en cientos o incluso miles de pasos de inferencia, lo que hace que la generación de tokens rápidos sea un paso crítico para las fábricas de IA.


Mientras que la Vera Rubin NVL72 de NVIDIA es la solución de vanguardia para la IA de Agencia, sus capacidades pueden reforzarse aún más con la solución Groq 3 LPX.


En una demostración, NVIDIA muestra su plataforma Vera Rubin NVL72 con Groq 3 LPX sacando un récord de 3.400 tokens por segundo en análisis artificial que ejecuta el modelo abierto Gemma 4 31B. Con una ventana de contexto de 100.000 tokens, este fue el rendimiento más rápido jamás registrado en el modelo.

Las GPU NVIDIA Rubin manejan el procesamiento de contexto a gran escala, mientras que LPX acelera las cargas de trabajo de decodificación sensibles a la latencia. El resultado es una generación de tokens más rápida y predecible que ayuda a las fábricas de IA a ofrecer un razonamiento receptivo, interacciones de agentes más fluidas y una mayor eficiencia de la infraestructura.



Con Groq 3 LPX, NVIDIA también permite que las tareas de IA actónicas, como la codificación, se realicen en cuestión de minutos en lugar de horas, ofreciendo un aumento de 4x en los tiempos de respuesta frente a la plataforma alternativa más cercana. ¡Grandes palabras ahí mismo!


“La inferencia es el motor de crecimiento de la IA. NVIDIA Grace Blackwell y NVL72 revolucionaron la inferencia del modelo de lenguaje grande con un salto sin precedentes en el rendimiento y la eficiencia”, dijo Jensen Huang, fundador y CEO de NVIDIA. “Vera Rubin amplía esa visión con configuraciones de fábrica de IA optimizadas para la carga de trabajo diseñadas para la era de la IA agente, avanzando en la frontera del rendimiento con LPX para la generación de tokens ultrarrápidos. Esto transforma la forma en que se produce la inteligencia, dando otro salto gigante en el rendimiento de la IA, la eficiencia y la capacidad de respuesta, al igual que la demanda de computación de IA se está acelerando en todo el mundo”.


La solución NVIDIA Groq 3 LPX también está siendo vista por los proveedores de la nube de IA como una solución a las crecientes necesidades, dando a las empresas y desarrolladores acceso a infraestructura avanzada para la capacitación, el razonamiento y la inferencia a escala. Como tal, Nebius planea utilizar Groq 3 LPX en su fábrica de tokens Nebius.


“La generación es la fase de inferencia que determina cuán sensible es realmente un sistema de IA, y eso es exactamente lo que NVIDIA Groq 3 LPX está construido para acelerar”, dijo Danila Shtan, directora de tecnología de Nebius. “Como la primera nube de inteligencia artificial que la lleva a producción a través de Nebius Token Factory, nos estamos asegurando de que cada paso del bucle de un agente se sienta instantáneo, a través de la misma API que los desarrolladores ya están utilizando, sin migración a una nueva pila”.


Groq 3 LPX y Vera Rubin, como combo, están diseñados para la era de la IA de Agentic, lo que brinda una arquitectura de inferencia diseñada específicamente diseñada para maximizar la capacidad de respuesta, el rendimiento y la eficiencia, ayudando a impulsar la próxima generación de fábricas de IA.


Fuente: Wccftech

Comentarios


Aplus_MARS_2107_Eng(1).png
undefined - Imgur(1).jpg

Siguenos

  • Facebook
  • Twitter
  • YouTube
  • Instagram
gaming

© 2016 Derechos Reservados a MasterbitzReviewHN

bottom of page