✅ CONTENIDO_COMPLETO | Traducido automáticamente del inglés
🍭 En esta nota me enfoqué en el impacto para experiencia de desarrollo, interfaces y ergonomía del producto.
El martes, la empresa de infraestructura de inteligencia artificial Runware anunció el lanzamiento de su propio centro de datos modular llamado Sonic Inference Pod. Diseñado como una única unidad transportable, el Pod representa un tipo de computación más flexible que puede acompañar los proyectos masivos de centros de datos de los hiperescaladores. Runware dice que Pod puede ofrecer inferencia con mayor calidad pero a menor costo que otras plataformas de inferencia sin servidor y nubes de GPU.
El diseño modular significa que es fácil agregar capacidad rápidamente mediante la creación de nuevos módulos en lugar de tener que expandir un centro de datos fijo. En cierto modo, este es el futuro, dijo a TechCrunch Flaviu Radulescu, cofundador y director ejecutivo de Runware. “Creemos que la computación distribuida, ubicada más cerca de los usuarios finales para una inferencia más rápida, es lo que ganará en el largo plazo”, dijo, señalando a su empresa como ejemplo.
Aparte de un precio más bajo, Radulescu señaló que el sistema runware puede escalar y agregar capacidad rápidamente, implementarse en cualquier lugar donde haya energía y adaptarse rápidamente a nuevos lanzamientos de hardware. Los módulos Runware tampoco utilizan agua, sino más bien un sistema de refrigeración de circuito cerrado que se puede construir en días, en comparación con los meses o incluso años que lleva construir los centros de datos tradicionales. “La demanda de inferencia está creciendo más rápido de lo que pueden construirse las instalaciones”, afirmó Radulescu.
“Lo que queremos es impulsar la inteligencia mundial, ser la columna vertebral de cada modelo de IA con una capacidad que se mantenga a la altura de la demanda en lugar de estrangularla”. Runware tiene actualmente 10 módulos implementados en EE. UU., Europa y Asia-Pacífico, dijo Radulescu. La compañía ya proporciona inferencias a algunas empresas, incluidas Higgsfield AI y Wix, y tiene 160 sitios disponibles para alimentar sus módulos en este momento. Runware anunció una Serie A de 50 millones de dólares en diciembre para proporcionar la infraestructura necesaria para que las empresas generen imágenes.
Ven la expansión a grupos como parte de la misión principal de la empresa: brindar inferencia a las empresas, en lugar de un solo producto. Créditos de imagen: los laboratorios Runware AI como OpenAI y SpaceX todavía están compitiendo para construir centros de datos en todo EE. UU. OpenAI, por ejemplo, está cerca de llegar a un acuerdo de 500 mil millones de dólares que le permitiría construir un centro de datos en Ohio, según los informes.
“Un error en el diseño de una placa de circuito cuesta meses entre el rediseño, la simulación, la fabricación, las pruebas y la entrega”, dijo. “Cada una de esas llamadas necesita a alguien que entienda exactamente qué hace cada componente y qué se estropea si se estropea”. Sin embargo, la construcción de centros de datos de IA es un tema controvertido, especialmente por la cantidad de recursos que utiliza. Las comunidades donde se encuentran los centros de datos ya han informado de un aumento en los costos de los servicios públicos.
Un día, Runware ve un mundo en el que puede funcionar con energía renovable y no recurrir a los recursos que las comunidades necesitan, pero ese día no es necesariamente hoy. Radulescu dijo que el uso de energía de la IA aumentará de todos modos, “impulsado por la demanda de inferencia, no por quién la suministra”. En lo que se centra Runware en este momento es en cómo se satisface esa demanda, dijo. “No hay pérdidas de transmisión, no hay agua en el enfriamiento, y estamos usando energía que ya existe en lugar de pedir una nueva red…
📰 Fuente Original
Hardware Ai – Leer artículo completo →
📌 Nota: Este artículo fue traducido automáticamente. Para la versión original en inglés, visita el enlace de la fuente.
🍭 Curada por Jicaleta con ojo en UX, frontend y claridad para devs.