25 de septiembre de 2026

Matemáticos rusos logran que modelos de IA se comuniquen sin palabras: un avance revolucionario en inteligencia artificial

Innovaciones en IA: La telepatía entre máquinas

Recientemente, tuve la oportunidad de conversar con un grupo de destacados matemáticos rusos que me revelaron un enfoque innovador en el campo de la inteligencia artificial (IA). Este grupo trabaja para una startup conocida como Mostik, cuyo nombre en ruso significa «puente». Este término simboliza su método de facilitar la comunicación entre diferentes modelos de IA, utilizando los valores matemáticos presentes en sus pesos, que son fundamentales para determinar cómo una instrucción se traduce en un resultado. Este avance permite que las capacidades de modelos más grandes se transfieran a otros más pequeños, mejorando su rendimiento de manera eficiente.

Mostik ha implementado esta técnica para desarrollar un modelo que ha alcanzado posiciones destacadas en la ARC-AGI 3, una competencia muy exigente para modelos de IA. Aunque los detalles concretos se mantienen bajo reserva para asegurar su triunfo en el certamen, han demostrado la efectividad de su enfoque creando un «puente» entre dos modelos de IA chinos de código abierto. Mientras que la versión más potente, GLM-5.2, cuenta con 753,000 millones de parámetros, la versión más compacta, Qwen-3.5, tiene solo 4,000 millones y es capaz de operar en dispositivos móviles. El modelo híbrido resultante opera a una fracción del costo del GLM completo, alcanzando un rendimiento que se sitúa entre ambos extremos.

La sinergia de múltiples modelos

Sasha Malysheva, directora ejecutiva de Mostik, compartió durante nuestra conversación que en el ámbito del aprendizaje automático, es un hecho bien conocido que los conjuntos de modelos tienden a superar a los modelos individuales. Ella ilustró esta idea con una broma común en su empresa, comparando el futuro de la IA con la curiosa tarea de adivinar el peso de un cerdo. En contextos matemáticos, se ha demostrado que un grupo de personas seleccionadas al azar puede estimar el peso de un cerdo con mayor precisión que un experto, cuando se combinan y promedian sus estimaciones.

Del mismo modo, al combinar los resultados de varios modelos de IA, se obtienen resultados más robustos. Sin embargo, el método tradicional de introducir el resultado de un modelo en otro puede ser costoso y consumir mucho tiempo. El equipo de Mostik ha encontrado una manera de permitir que los modelos de IA se comuniquen entre sí sin necesidad de generar texto, lo que podría aumentar significativamente el valor de los modelos de código abierto, permitiéndoles competir más efectivamente con las soluciones de código cerrado ofrecidas por laboratorios de renombre como OpenAI y Anthropic.

El futuro de la IA: más allá de los modelos monolíticos

Malysheva está convencida de que la combinación de diversos modelos podría ser una estrategia más eficaz para avanzar en el ámbito de la IA. Ella argumenta que no es probable que surja un único modelo monolítico en el futuro, ni que las capacidades de los modelos se logren simplemente a través de su escalado. Vladimir Arustamian, director técnico de la empresa de software de IA Lovable, también reconoce el potencial de Mostik, sugiriendo que su enfoque podría facilitar el desarrollo de numerosos modelos especializados en campos concretos como la biología o la física.

Karl Tuyls, exinformático de Google DeepMind, explica que la técnica empleada por Mostik permite alcanzar niveles de calidad similares a los de los grandes modelos sin necesidad de que estos gestionen todo el proceso. Esto se traduce en mejoras significativas al operar con modelos más pequeños en paralelo, una estrategia que resulta obvia para quienes buscan ejecutar modelos de la manera más eficiente posible.

Superando desafíos matemáticos en IA

Stanislav Smirnov, profesor en la Universidad de Ginebra y galardonado con la Medalla Fields en 2010, es el científico principal de Mostik. Él destaca que encontrar un punto en común entre dos modelos de IA es un desafío sorprendentemente complicado, señalando que aún no se ha desarrollado un lenguaje matemático adecuado para esto. El trabajo de Mostik representa un intento de salvar esta brecha.

Smirnov también sugiere que los esfuerzos de Mostik podrían arrojar nueva luz sobre el funcionamiento de los modelos de IA y establecer comparaciones con el razonamiento humano. Un análisis matemático más riguroso podría revelar similitudes en la manera en que tanto los modelos de IA como los seres humanos abordan problemas complejos.

El camino de la perseverancia hacia el éxito

Durante nuestra charla, Malysheva compartió que descubrió su inclinación por las matemáticas tras recibir un reto de su hermano mayor, quien dudaba de su capacidad para resolver problemas de la Olimpiada Matemática. Años después, se encontraba estudiando en una de las instituciones educativas más prestigiosas de San Petersburgo. Recientemente, algunos colegas le hicieron notar que la técnica del puente podría ser demasiado complicada de implementar.

“Me dijeron que podría ser demasiado difícil para una chica joven”, recuerda Malysheva. “Decidí que tenía que demostrarles que estaban equivocados”. Este espíritu de desafío y perseverancia es un reflejo del compromiso del equipo de Mostik para innovar en el ámbito de la inteligencia artificial.