Hasta ahora no se me había ocurrido una buena forma de aprovechar una LLM para ayudarme en el diseño de juegos, pero creo que he encontrado un filón. GPT está resultando muy bueno en equilibrar puntuaciones para fabricar un prototipo, es decir, en el paso previo a enviar el juego a testeo. Concretamente, en el caso de ameritrashes de facciones asimétricas o euros temáticos que es lo que a mí me gusta diseñar.
Y es que la mayoría de juegos que hacemos normalmente pertenecen a un género que suele estar algo trillado y hasta cierto punto resuelto. Si haces un deckbuilder, según el tipo de generación y consumo de recursos que implementes se parecerá algo a Dominion o a Slay the Spire. Si haces un mazmorrero, a Heroquest o a Descent. Si haces un juego de batallitas, a warhammer. Si haces un juego de cartas confrontacional, a Magic o a Hearthstone/Duelmasters.
Y sobre estos juegos "famosos", en internet suele haber bases de datos con puntuaciones, historial de correcciones, discusiones... a los que la LLM puede acceder.
Así que muchas de las dudas sobre valores iniciales de tu juego las puedes preguntar explicándole a la LLM las diferencias fundamentales entre tu juego y el juego famoso más cercano, y entonces preguntarle qué valores debería tener esta pieza con la que tengo problemas asignándole un valor inicial porque no tengo ni idea de dónde caería.
Por ejemplo, estás haciendo un ripoff de Magic, y quieres que tenga un nivel de poder similar al de Magic cuando estaba en la expansión "Alianzas". Sólo tienes que explicarle a la LLM las diferencias entre tu juego y Magic (el maná sale de cartas que descartas de tu mano a lo Lorcana y puedes ahorrar maná de un turno a otro, y algunas cartas se pagan con vida y no hay contrahechizos... cosas así). Y entonces, si quieres meter una criatura con habilidad marciana que no exista en Magic o que no exista en el nivel de poder de "Alianzas" en el nivel de maná que tú quieres... le puedes preguntar a la IA. Ésta se come todo el "number crunching" y te da un abanico de opciones que acierta bastante. E incluye bastante bien las correcciones debidas a las diferencias entre tu juego y el otro: cosas como "ya que en tu juego las criaturas heridas reducen su fuerza a la mitad, los hechizos que hacen daño tienen doble uso como debuff así que deberían ser algo más caros".
Lo he comprobado tomando un juego que ya tengo diseñado y playtesteado, le he preguntado "¿cuánta fuerza le pondrías a esta criatura?" o "¿cuánto coste a este hechizo?" y siempre me contesta valores que coinciden o se desvían muy poco de los que finalmente ha tenido mi juego.
Así que me está resultando bastante útil y el tema de que te dé varias opciones alguna vez ha servido de "brainstorming leve" y ha hecho que se me ocurra alguna idea nueva de cómo terminar creando un efecto concreto. De hecho ya hay un par de casos donde me he desviado mucho de la curva, porque a veces mi cerebro patina, y la LLM me ha ayudado a detectar la discrepancia sin que tenga que pasar por playtesting. Y eso es muy útil.
¿Alguien ha hecho algo parecido por aquí?