OpenAI y Broadcom presentan el chip Jalapeño para la inferencia de grandes modelos de lenguaje

OpenAI y Broadcom se asocian en silicio personalizado para IA
OpenAI y Broadcom han anunciado un nuevo chip diseñado específicamente para la inferencia de grandes modelos de lenguaje en centros de datos, lo que marca otra señal de que la industria de la IA se está adentrando más en el hardware personalizado.
El chip, llamado Jalapeño, se presenta como la primera generación de una colaboración a más largo plazo entre ambas empresas. Broadcom afirmó que el ASIC fue diseñado desde cero para la inferencia de grandes modelos de lenguaje, basándose en "conocimientos detallados" de las conversaciones con los investigadores de OpenAI y la hoja de ruta de la compañía para futuros modelos y productos. Broadcom dijo que el chip fue diseñado y fabricado en nueve meses.
OpenAI dijo que las pruebas iniciales sugieren que Jalapeño ofrecerá "un rendimiento por vatio sustancialmente mejor que el estado del arte actual", aunque agregó que las pruebas siguen en curso y que un informe técnico más detallado se publicará en los próximos meses.
El esfuerzo refleja la ambición más amplia de OpenAI de controlar más de la infraestructura detrás de sus modelos y productos, reduciendo la dependencia de proveedores externos como Nvidia. También se produce en un momento en que las empresas de IA siguen buscando formas de optimizar recursos de cómputo limitados en medio de una crisis global de centros de datos.
Broadcom, que ya es un importante proveedor de chips para constructores de infraestructura, ha estado expandiendo su negocio de silicio personalizado a medida que los hiperescaladores y los desarrolladores de modelos de vanguardia buscan chips especializados adaptados a sus propias cargas de trabajo.
Ambas compañías dijeron que se espera que los chips Jalapeño se desplieguen en centros de datos antes de que termine este año.
Fuentes:
Lee más noticias tecnológicas en el Doppler VPN Blog.