El mejor LLM para Godot: cómo probar uno tú
Cualquier clasificación de modelos de lenguaje para Godot se queda anticuada en semanas, porque los modelos cambian más rápido que los artículos. Lo que perdura es una prueba que puedes hacer tú, y un hallazgo que se cumple en todos los modelos: el contexto sobre tu proyecto importa más que el tamaño.
Publicado el 2026-09-28 · Guides
Por qué caducan las clasificaciones
Salen modelos nuevos cada pocas semanas, y cada proveedor actualiza los antiguos en silencio. Una tabla del mejor modelo para Godot escrita en primavera está mal en verano.
Así que, en lugar de una clasificación, aquí tienes cómo decidirlo tú en media hora.
La prueba de los cinco prompts
Pide a cada modelo las mismas cinco cosas en un chat nuevo. Un controlador de plataformas con CharacterBody2D. Una señal de un botón a una función. Un temporizador usando await. Un enemigo que sigue a quien juega con NavigationAgent2D. Un archivo de guardado escrito con FileAccess.
Puntúa cada uno según si funciona en Godot 4 sin editarlo. El modelo que aprueba más es tu mejor modelo, este mes.
El contexto gana al tamaño
Un modelo más pequeño al que das los scripts de tu proyecto, la versión de Godot y el error exacto a menudo gana a uno más grande al que no das nada. Por eso ayudan tanto los servidores MCP y los plugins del editor: aportan contexto automáticamente.
También es por lo que las herramientas con operaciones potentes y de alto nivel dejan que modelos más baratos funcionen bien. Cuantos menos detalles tiene que inventar un modelo, en menos se equivoca.
Modelos locales
Ejecutar un modelo en tu propio equipo con Ollama no cuesta nada por petición y mantiene el código privado. AI Assistant Hub para Godot puede usar uno.
Los modelos locales suelen ser más flojos en los detalles de Godot 4. Dales más contexto y tareas más pequeñas.
Qué hace Flockbay con el modelo
En la app Flockbay no eliges el modelo; la IA trabaja con las propias herramientas de la app, que están diseñadas para que la fiabilidad salga de las herramientas y no de un modelo más grande.
Puedes conectar tu propio agente por MCP, gratis, con el modelo que use, a esas mismas herramientas de mundo.
Apuntar tus resultados
Ten una tabla pequeña: la fecha, el modelo y cuáles de los cinco prompts funcionaron sin editar. Repítela cuando notes más errores de lo habitual o cuando salga un modelo nuevo.
Al cabo de unos meses la tabla te dice más que cualquier reseña, porque pone a prueba los modelos en exactamente lo que tú haces.
La prueba de verdad
Elijas el modelo que elijas, la prueba final es el juego. Juega cada cambio. Un modelo que escribe un código perfecto para el comportamiento equivocado sigue estando equivocado.
Descarga Flockbay
Haz la prueba de los cinco prompts cada mes. Dale más contexto a cualquier modelo antes de rendirte con él.
