top of page
IG.png

La startup coreana de IA Furiosa AI duplicará su producción de chips hasta alcanzar las 50 000 unidades el año que viene, mientras que su próximo chip «Stork» de 2 nm plantará cara a NVIDIA

  • Foto del escritor: Masterbitz
    Masterbitz
  • 13 jul
  • 4 min de lectura

Furiosa AI está listo para duplicar su producción de chips a 50.000 unidades mientras prepara su chip "Stork" de 2 nm para romper el dominio de la inferencia de NVIDIA.

Furiosa AI afirma que su chip de 3a generación "Stork" de 2nm contará con las mejores capacidades de inferencia del mercado, también duplicará la producción de chips de 2a generación el próximo año para romper el monopolio de NVIDIA

En mayo, Furiosa AI anunció su chip acelerador de IA de tercera generación llamado Stork para su plataforma RNGD (Renegade). El chip se basa en la tecnología de 2nm de Broadcom, y la startup afirma que desafiará a NVIDIA con una eficiencia líder y el menor costo por token.


Según fuentes de la industria el 13, Furiosa AI planea expandir significativamente el volumen de producción de su chip especializado en inferencia LLM de segunda generación, "Renegade (RNGD)" a 40,000 a 50,000 unidades para el próximo año. Esto representa más de un doble aumento en comparación con las 20.000 unidades de este año. Esta es la primera vez que se confirman los planes de producción del próximo año de Furiosa AI, una empresa nacional líder en semiconductores de IA. Vía ETNews


El chip Gen actual de 2 nm ya ha entrado en producción en masa y se espera que vea 20.000 unidades listas en 2026. Pero Furiosa AI tiene planes más ambiciosos para sus aceleradores de IA. Estos planes incluyen duplicar la producción de chips a 40K-50K unidades el próximo año. La compañía ha declarado que el rápido aumento en la inferencia de IA los ha llevado a duplicar la producción, ya que anticipan una gran demanda en función de sus recientes aspectos destacados.

El chip de cigüeña de Furiosa AI: un disruptor de inferencia de IA de 2nm

El diseño de próxima generación va a ir all-in en el segmento de inferencia de IA a medida que la IA de Agentic continúa viendo una gran demanda. El acelerador de IA de tercera generación de FuriosaAI tiene los siguientes aspectos destacados:


  • La plataforma combina tecnología de computación de 2 nm con memoria HBM4/4E, diseñada para permitir redes de alto ancho de banda y escala de rack a través de clústeres de computación de IA masiva.

  • La arquitectura está optimizada para cargas de trabajo de inferencia exigentes con un enfoque en el movimiento de datos de alto ancho de banda que ofrece un mayor rendimiento por vatio y una mayor densidad de tokens que incluso las GPU más eficientes.

  • Se basa en el chip RNGD de generación actual de Furiosa, ahora en producción en masa. Los clientes incluyen Samsung SDS y LG AI Research.


A partir de algunos de los detalles compartidos por FuriosaAI, la plataforma de chips Stork AI utilizará un avanzado dado de computación de 2nm y un estándar de memoria HBM4/E. La firma está trabajando con Broadcom para aprovechar las capacidades avanzadas de empaque, lo que les permite integrar múltiples matrices de silicio en un chip de inteligencia artificial singular y eficiente (System-on-chip).

En la toma teaser, la compañía muestra el chip AI de 3a generación con 12 sitios de memoria HBM4/E, dos chips de computación masivos (2 nm) y dos controladores IO. Eso redondea hasta 432 GB si Furiosa utiliza 12-Hi 36 GB por pila de módulos de memoria.


Además de la arquitectura de computación, FuriosaAI también aprovechará las IP Ethernet y PCIe de Broadcom, lo que permitirá un mayor ancho de banda y redes a escala de rack a través de clústeres de computación de IA masiva. El chip de IA está optimizado para cargas de trabajo de inteligencia artificial exigentes en el mundo real, como el muestreo posterior a la capacitación, y el alto ancho de banda es un enfoque clave y es por eso que la compañía va con los últimos estándares HBM4/E.

La compañía afirma que su enfoque en el ancho de banda en lugar de la gestión de subprocesos (requerida por las GPU) le ayudará a ofrecer una mayor eficiencia y un mayor rendimiento de tokens que los diseños de GPU modernos. Además, la compañía está diciendo que su pila de software permite a los desarrolladores implementar nuevos modelos de IA rápidamente al tiempo que cumplen con los requisitos de rendimiento y latencia.


El SDK de Furiosa aprovecha un compilador general que mapea automáticamente el código PyTorch de alto nivel en silicio. Para los desarrolladores que requieren un control más granular, la ISA virtual de Furiosa ofrece un modelo de programación declarativa que proporciona control de hardware sin la complejidad no determinista de la programación de GPU tradicional.


“Reunir las capacidades de infraestructura de Broadcom y la arquitectura de procesador de contracción de tensores de Furiosa y su pila de software que define la industria nos permite superar el nivel de chip y ofrecer una solución integral para la era de la fábrica de tokens”, dijo el cofundador y CEO de Furiosa, June Paik.


En cuanto a la disponibilidad, se espera que el acelerador 3er Gen FuriosaAI comience a muestrear en el primer semestre de 2028 y estará listo para cumplir con los requisitos de computación para los centros de datos de inteligencia artificial de próxima generación.


Fuente: Wccftech

Comentarios


Aplus_MARS_2107_Eng(1).png
undefined - Imgur(1).jpg

Siguenos

  • Facebook
  • Twitter
  • YouTube
  • Instagram
gaming

© 2016 Derechos Reservados a MasterbitzReviewHN

bottom of page