Ant Group ha abierto oficialmente los pesos de Ling-3.0-flash, ofreciendo la versión original BF16 y la versión cuantificada FP8, ambas bajo la licencia MIT. Ya están disponibles en Hugging Face y ModelScope, y se pueden implementar de forma independiente utilizando SGLang o vLLM. La versión BF16 ocupa aproximadamente 255GB, mientras que la versión FP8 ocupa alrededor de 128GB, lo que representa casi una reducción a la mitad. FP8 conserva parámetros con una precisión más baja, reduciendo así el umbral de almacenamiento y memoria de video. Las pruebas oficiales muestran que la diferencia máxima entre FP8 y BF16 es de 1.57 puntos. Ling-3.0-flash tiene un total de 124 mil millones de parámetros, activando solo 5.1 mil millones por generación, y soporta un contexto de 256,000 tokens, dirigido principalmente a tareas de agentes como programación, búsqueda, investigación profunda y llamadas a herramientas. Las evaluaciones oficiales indican que este modelo alcanza o supera a su predecesor Ring-2.6-1T de un billón de parámetros en la mayoría de los benchmarks.
Este contenido se ofrece únicamente con fines informativos generales y no constituye asesoramiento financiero, de inversión, legal ni fiscal. Cualquier evento, recompensa, promoción en línea o información relacionada que se mencione en el presente documento no debe considerarse como una recomendación, solicitud o invitación a comprar, vender, tradear o de negociar de otra manera con cualquier criptoactivo. Los criptoactivos son sumamente volátiles y pueden provocar pérdidas. La disponibilidad de los servicios, productos y eventos relacionados de WEEX puede variar según la región. Tienes la responsabilidad de asegurarte de que tu participación esté de acuerdo con las leyes y regulaciones locales vigentes.





























