IBM ha firmado un acuerdo de 240 millones de dólares con Together AI para utilizar un clúster de inferencia equipado con aproximadamente 2.000 chips Nvidia Blackwell 300.
La inferencia es el trabajo que ocurre cuando un modelo ya entrenado responde, clasifica, busca o ejecuta una tarea. En productos con muchos usuarios, esa fase puede consumir más capacidad acumulada que el entrenamiento inicial.
Together AI se especializa en servir modelos abiertos. IBM quiere ofrecer a sus clientes una arquitectura donde puedan elegir y cambiar modelos según coste, privacidad y capacidad.
La flexibilidad no es automática. Aplicaciones, evaluaciones y datos deben estar diseñados para comparar resultados. Cambiar el modelo sin medir calidad puede sustituir dependencia por incertidumbre.
PublicidadARQUITHEAArquitectura para mirar mejorIdeas, obras y herramientas para entender la ciudad desde preguntas reales.Sigue @arquithea_ ↗El dato. IBM reserva capacidad antes de que el servicio entre en funcionamiento. La lectura editorial es que la competencia empresarial se desplaza hacia quién permite combinar modelos sin quedar encerrado en uno.
¿Por qué una empresa querría varios modelos en lugar de uno excelente?
Porque clasificación, contrato, imagen y código no tienen el mismo coste ni el mismo riesgo. Poder elegir permite reservar el modelo caro para lo difícil y usar otros más económicos donde la calidad suficiente basta.