El 3 de agosto, el analista Jukan publicó que el desarrollo continuo de modelos de IA de código abierto y la debilitación del monopolio de modelos de código cerrado podrían convertirse en un punto de inflexión importante para la industria de la computación en la nube, beneficiando a los proveedores de nube al aumentar el valor comercial de la infraestructura de IA.
Jukan señaló que la preocupación central que enfrentaban los proveedores de nube en el pasado era que, tras realizar grandes inversiones en la compra de GPU y la construcción de centros de datos, podrían terminar proporcionando infraestructura solo para unas pocas empresas de modelos de código cerrado, mientras que estas empresas controlaban el acceso de los usuarios y el poder de fijación de precios.
Sin embargo, a medida que el rendimiento de los modelos de código abierto mejora y los costos disminuyen, el modelo de aplicación de IA está cambiando de "un único modelo de alto rendimiento que resuelve todas las tareas" a "enrutamiento de modelos en capas". Las tareas de razonamiento complejas seguirán siendo manejadas por los principales modelos de código cerrado, mientras que una gran cantidad de tareas ordinarias podrán ser realizadas por modelos pequeños de bajo costo o modelos de código abierto.
Él cree que, con el aumento de la sustituibilidad de los modelos, los proveedores de nube obtendrán más acceso de usuarios, control de tráfico y capacidad de fijación de precios. En el futuro, los modelos de código cerrado podrían dejar de ser "canales de cobro" sobre la computación en la nube, y más bien parecerse a recursos de computación que pueden ser gestionados libremente por las plataformas en la nube.
Además, la competencia de modelos de código abierto no significa que la demanda de hardware disminuya. Jukan afirmó que los costos de razonamiento más bajos podrían impulsar un rápido crecimiento en el volumen de llamadas de IA, mientras que la compresión de modelos, la optimización de razonamiento, el enrutamiento inteligente y los chips ASIC desarrollados internamente reducirán los recursos de GPU generales necesarios por token.
Él considera que el crecimiento a largo plazo de la infraestructura de IA depende de si la velocidad de crecimiento de la demanda supera la velocidad de mejora de la eficiencia. Si el uso de tokens crece más allá de las mejoras en la eficiencia de algoritmos y chips, la tasa de utilización de los centros de datos y el retorno de capital aún pueden mantenerse en niveles altos, impulsando a los proveedores de nube a seguir invirtiendo en infraestructura de potencia de cálculo.
Jukan concluyó que la lógica del verdadero mercado alcista de infraestructura de IA no se basa simplemente en "modelos baratos que benefician a la nube, y el crecimiento de la nube que beneficia al hardware", sino en que los modelos de código abierto reducen las ganancias monopolísticas de los niveles de modelos, y los proveedores de nube mejoran la eficiencia de monetización de los recursos de computación a través de la gestión de potencia de cálculo y la integración vertical, formando finalmente un ciclo positivo entre la computación en la nube y la inversión en hardware.
Este contenido se ofrece únicamente con fines informativos generales y no constituye asesoramiento financiero, de inversión, legal ni fiscal. Cualquier evento, recompensa, promoción en línea o información relacionada que se mencione en el presente documento no debe considerarse como una recomendación, solicitud o invitación a comprar, vender, tradear o de negociar de otra manera con cualquier criptoactivo. Los criptoactivos son sumamente volátiles y pueden provocar pérdidas. La disponibilidad de los servicios, productos y eventos relacionados de WEEX puede variar según la región. Tienes la responsabilidad de asegurarte de que tu participación esté de acuerdo con las leyes y regulaciones locales vigentes.





























