El lanzamiento del Grok 3: una nueva propuesta en inteligencia artificial
Elon Musk, conocido por sus incursiones innovadoras en SpaceX, Tesla y Neuralink, ha lanzado finalmente lo que describe como la “IA más inteligente de la Tierra”: Grok 3. Este lanzamiento de su empresa xAI se presenta como una de las propuestas más novedosas entre los chatbots más conocidos, compitiendo directamente con la reputada inteligencia artificial de OpenAI.
Innovaciones tecnológicas y competencia en el mundo de las IAs
El lanzamiento de Grok 3 ha llamado la atención en el panorama tecnológico, especialmente ante las expectativas del inminente modelo GPT-4.5 de OpenAI presentado por Sam Altman. A pesar de su prometedora presentación, algunos especialistas en España han identificado áreas donde Grok 3 podría no ser tan infalible como se promociona, exponiendo ciertas debilidades en los modelos de inteligencia artificial.
Benchmarking y percepción pública
Los benchmarks son herramientas cruciales para medir el rendimiento en razonamiento, velocidad, y más, de las inteligencias artificiales. A través de diversas pruebas, Grok 3 aparentemente supera a varios competidores como Gemini 2 Pro, DeepSeek V3, y GPT 4.0. Sin embargo, expertos sugieren que estas afirmaciones pueden ser más marketing que realidad.
El escepticismo detrás del rendimiento de Grok 3
Julio Gonzalo, Catedrático de la UNED, junto a otros investigadores, han señalado que las demostraciones de rendimiento de inteligencia artificial pueden manipularse para mostrar datos impresionantes al público. Según El País, se ha descubierto un método para verificar qué tan efectiva puede ser una IA usando la repetida frase “Ninguna de las otras” en las pruebas.
“La respuesta acertada tiene un vocabulario completamente desconectado de la pregunta, lo que le obliga a razonar sobre cada una de las otras respuestas posibles y descartarlas, es una variación mucho más exigente. Es verdadera kriptonita para los modelos”. — Julio Gonzalo.
Los investigadores han notado que al usar este método, se observa una pérdida de entre el 50% y 57% en efectividad y precisión en las respuestas de las IAs, destacando limitaciones en su capacidad de razonamiento intuitivo.
El impacto de la tecnología y el futuro
A medida que el desarrollo de IA sigue avanzando con nuevas incorporaciones como ChatGPT-o3 mini y DeepSeek R1-70b, estas limitaciones podrían superarse eventualmente. Entretanto, la diferencia en el rendimiento al trabajar en diferentes idiomas, como inglés y español, debe ser tenida en cuenta, considerando que algunas tecnologías funcionan mejor en un idioma sobre otro.
De este modo, aunque partes del marketing puedan sobredimensionar las capacidades actuales de IAs como Grok 3, estas tecnologías proporcionan un interesante campo de acción para comprobar sus verdaderas capacidades y limitaciones, un aspecto crucial para los futuros lanzamientos de compañías como xAI, OpenAI, Google y Microsoft.
¿Te gustó esta noticia?
Recibe las mejores noticias de Puente Alto cada semana directamente en tu correo.
📧 Sin spam • Cancela cuando quieras • +2,500 suscritos


