Inteligencia artificial

Anthropic ficha al pionero de los TPU de Google para sus chips

Publicado el 6 min readPor NewUJ Editorial Desk

Actualizado el se añadió nueva información

Anthropic ficha al pionero de los TPU de Google para sus chips
0 0
XWhatsAppTelegramLinkedIn

# Anthropic ficha al pionero de los TPU de Google para sus chips

Anthropic está acelerando su incursión en el hardware de IA personalizado al contratar a una de las figuras clave detrás del programa de Unidades de Procesamiento Tensorial (TPU) de Google, mientras el creador de Claude comienza a desarrollar sus propias capacidades de semiconductores.

Amir Salek, exejecutivo de Google que ayudó a liderar los esfuerzos de silicio personalizado de la compañía, se une al equipo de cómputo de Anthropic, según informó Bloomberg.

El movimiento es significativo porque Anthropic ya ha confirmado que está formando un equipo interno para diseñar chips optimizados para Claude.

En conjunto, estos avances sugieren que una de las mayores empresas de IA del mundo quiere un mayor control sobre el hardware que sustenta sus modelos.

## Anthropic ficha a un veterano de los TPU de Google

Salek pasó casi una década en Google y ayudó a liderar su programa de chips personalizados.

Durante su tiempo allí, participó en la entrega de las primeras siete generaciones de las Unidades de Procesamiento Tensorial (TPU) de Google, según Bloomberg.

Los TPU son procesadores especializados diseñados específicamente para cargas de trabajo de aprendizaje automático.

A diferencia de los procesadores de propósito general, los aceleradores de IA pueden optimizarse en torno a los enormes cálculos matriciales necesarios para entrenar y ejecutar redes neuronales.

La decisión de Google de desarrollar TPU le dio a la compañía una alternativa a depender exclusivamente de las GPU de empresas como Nvidia.

Anthropic ahora está comenzando un viaje similar.

Salek se unirá a la organización de cómputo de Anthropic y reportará a James Bradbury, según Bloomberg.

Antes de Google, Salek también pasó años en Nvidia, lo que le brinda experiencia en dos de las empresas más importantes en el hardware de IA moderno.

## Anthropic ya ha confirmado sus planes de chips personalizados

La contratación sigue a un importante anuncio de Anthropic a principios de este mes.

El 5 de agosto, la compañía confirmó que estaba creando un equipo interno de silicio personalizado para diseñar chips para sus modelos de IA Claude.

Anthropic dijo que quiere que ingenieros de todo el stack de hardware y software trabajen juntos en procesadores específicamente optimizados para sus modelos.

El objetivo es hacer que Claude sea más rápido y eficiente, al tiempo que se respalda la enorme escala requerida por los servicios de IA cada vez más populares.

La página de carreras actual de Anthropic también muestra a la compañía reclutando para puestos relacionados con hardware, incluido un rol de Ingeniero de Investigación centrado en el aprendizaje por refuerzo para diseño de chips e ingeniería de kernels de TPU.

Eso hace que la contratación de Salek sea particularmente notable.

Anthropic ya no solo está explorando la idea de diseñar chips.

Está reclutando personas con experiencia en la construcción de algunos de los aceleradores de IA más exitosos del mundo.

## ¿Por qué Claude necesita su propio chip?

Ejecutar modelos de IA de frontera requiere enormes cantidades de potencia de cómputo.

Las empresas que desarrollan sistemas como Claude han dependido tradicionalmente en gran medida de procesadores diseñados por otras compañías.

Anthropic actualmente utiliza una estrategia de infraestructura diversificada que incluye tecnología de Amazon Web Services, Google, Nvidia y AMD.

La compañía dice que planea continuar usando esas plataformas incluso mientras desarrolla su propio silicio.

Pero el hardware personalizado ofrece varias ventajas potenciales.

En lugar de diseñar software en torno al hardware disponible, Anthropic podría eventualmente diseñar Claude y sus procesadores juntos.

Eso podría mejorar el rendimiento, reducir el consumo de energía y potencialmente reducir el costo de generar respuestas de IA.

También podría reducir la exposición a la escasez de los aceleradores de IA más avanzados.

Anthropic citó la disponibilidad limitada de chips como una de las motivaciones detrás de su decisión de crear un equipo de silicio personalizado.

## Nvidia no desaparecerá de los centros de datos de Anthropic

Desarrollar un acelerador de IA personalizado no significa que Anthropic abandone a Nvidia o a sus otros socios de hardware.

Anthropic ha descrito explícitamente la iniciativa como parte de una estrategia de múltiples chips.

La compañía espera que las GPU de Nvidia, los TPU de Google, los procesadores Trainium de Amazon y el hardware de AMD sigan desempeñando roles importantes en su infraestructura.

Construir un procesador de última generación también es extremadamente costoso.

Reuters informó que desarrollar un chip de IA avanzado puede costar aproximadamente 500 millones de dólares una vez que se incluyen ingeniería, verificación y preparación de fabricación.

Anthropic no ha anunciado cuándo podría aparecer su primer procesador diseñado internamente ni qué fabricante de semiconductores lo produciría.

Eso significa que cualquier acelerador Claude diseñado por Anthropic probablemente aún esté lejos.

## Las empresas de IA quieren más control sobre su hardware

El movimiento de Anthropic refleja un cambio mucho más amplio en la industria de la inteligencia artificial.

Las mayores empresas de IA ven cada vez más los chips como una parte estratégica de sus negocios, en lugar de un componente que simplemente compran.

Google ha desarrollado TPU durante años.

Amazon tiene Trainium e Inferentia.

Meta ha desarrollado su acelerador MTIA.

OpenAI también ha estado buscando silicio personalizado.

Ahora Anthropic está construyendo su propio equipo.

La razón es sencilla: los modelos de IA se están volviendo tan costosos de entrenar y operar que incluso pequeñas mejoras en la eficiencia del hardware pueden producir enormes ahorros cuando se multiplican en centros de datos masivos.

Un mayor control sobre el diseño de chips también puede permitir a los desarrolladores de IA optimizar los procesadores en torno a las cargas de trabajo exactas generadas por sus modelos.

## Las ambiciones de cómputo de Anthropic son cada vez mayores

La compañía está asegurando simultáneamente enormes cantidades de infraestructura de cómputo.

En junio, Apollo y Blackstone respaldaron una expansión de aproximadamente 35 mil millones de dólares en capacidad de cómputo vinculada a Anthropic y Broadcom, según Reuters.

La primera fase involucra aproximadamente un gigavatio de capacidad de cómputo, con planes a largo plazo conectados a despliegues sustancialmente mayores.

Eso ayuda a mostrar la escala del problema que Anthropic intenta resolver.

Claude ya no es simplemente un software que se ejecuta en un puñado de GPU.

Soportar modelos de IA de frontera requiere cada vez más centros de datos, redes especializadas, infraestructura de energía y cientos de miles de procesadores avanzados.

Al contratar a uno de los arquitectos del esfuerzo de TPU de Google, Anthropic está señalando que quiere participar mucho más profundamente en esa pila tecnológica.

La competencia entre las empresas de IA ya no se trata solo de quién tiene el mejor modelo.

Cada vez más, también se trata de quién controla los chips que lo sustentan.

Report / request removal

Relacionado

Comments

No comments yet. Be the first.