Los expertos asocian el aumento de los costos con las crecientes demandas de las nuevas LLM en cuanto a memoria y potencia computacional.
El despliegue de grandes modelos de lenguaje en Russia se ha encarecido notablemente en el último año. Según MWS Cloud, el costo promedio de una configuración mínima en aceleradores Nvidia para lanzar una LLM aumentó de 13,7 millones de rublos en 2025 a 38,8 millones de rublos en 2026, un aumento de 2,8 veces.
El estudio comparó siete modelos de 2026 con seis soluciones presentadas el año anterior. Los cálculos tuvieron en cuenta el número mínimo de GPU necesarias para procesar una solicitud del volumen máximo declarado, así como los servidores y el equipo de red.
El modelo más caro de desplegar en 2025 fue Kimi K2, con un costo de aproximadamente 35 millones de rublos por ocho H200. En 2026, el líder fue Kimi K3: ocho aceleradores B300 costarán aproximadamente 80 millones de rublos. Qwen3.5, DeepSeek-V4-Pro y GLM-5.2 requieren ocho H200 cada uno, y el costo de dicha configuración se estima en 55 millones de rublos.
El aumento de los costos se debe al crecimiento del tamaño y las capacidades de los nuevos modelos. Para procesar grandes volúmenes de datos, requieren más memoria de video y aceleradores de alto rendimiento, que también se están encareciendo debido a la alta demanda global.
MWS Cloud también estudió el uso de los Huawei Ascend 910B chinos. El número promedio de estos aceleradores para los modelos compatibles aumentó de 10,7 a 13,6 en un año. Sin embargo, no hay un precio oficial exacto para ellos, y el costo estimado es del 50-67% de las soluciones Nvidia comparables.
