Control de fixture
Fije revisión, versión de Unreal, plugins, assets, plataforma, modo de compilación, prompt y herramientas.
Laboratorio de evaluación Qwen3.8 × Unreal
Un benchmark útil corrige la revisión, tarea, evidencia, presupuesto, evaluador y ruta de recuperación. Mide si un cambio funciona, no si la respuesta suena senior.
No existe un benchmark oficial público de Qwen3.8 para Unreal establecido. Cree una suite local que puntúe finalización, tasa de compilación a primer intento, tasa de APIs inventadas, regresiones, calidad de evidencia, tiempo de revisión humana y comportamiento empaquetado bajo condiciones idénticas.

Fecha de captura: 20 de julio de 2026. Vuelve a verificar declaraciones de vista previa, disponibilidad, plan, precios y mensajes de open-weight dependientes del tiempo antes de actuar.
Fije revisión, versión de Unreal, plugins, assets, plataforma, modo de compilación, prompt y herramientas.
Evalúa compilación, tiempo de ejecución, automatización, empaquetado, corrección, latencia, coste, revisión y recuperación.
Oculte la identidad del modelo cuando sea práctico y use una sola rúbrica para los intentos de modelo y humanos.
Conserve primeros fallos, diferencias rechazadas, registros y resultados de rollback; los reintentos silenciosos distorsionan la fiabilidad.
Elija una corrección de compilación, revisión de Blueprint, error en tiempo de ejecución, problema de activos/configuración y verificación de build empaquetado.
Documenta el propietario esperado, la ruta de aceptación, los cambios prohibidos y la evidencia mínima.
Use el mismo contexto, herramientas, tiempo, techo de créditos y reglas de parada.
Aplique la rúbrica, revise ciegamente, repita tareas inestables y publique límites.
Reparar un fallo de compilación determinista único. Explica el primer error, propone la diferencia mínima y deténte si falta evidencia.
Diagnostique un desajuste cliente/servidor y nombre el límite de autoridad, además de una prueba de corrección reproducible.
Revisa capturas antes/después, pasos de juego y registros; devuelve una matriz de fallos y el disparador de rollback.
Separe los activos faltantes de los errores de módulo/configuración y proponga un cambio de diagnóstico a la vez.
IDs de tarea, revisiones, entradas, herramientas, presupuestos, pesos y exclusiones.
Prompts, respuestas, diffs, comandos, tiempos, costes, fallos y notas.
Finalización, compilación, ejecución, empaquetado, invención, regresión, tiempo de revisión y reproducibilidad.
Usos aprobados, usos prohibidos, supervisión, fecha de repetición y responsable de rollback.
SEELE AI puede generar un juego nativo de Unreal 5, previsualizarlo en el navegador, optimizarlo y empaquetarlo, y proporcionar un juego descargable o una construcción empaquetada para publicación externa o juegos Seele de pago. Las ventas no están garantizadas.
Las fuentes de lanzamiento citadas no proporcionan un benchmark específico de Unreal público.
Use la corrección de tarea comprobada por evidencia de build, runtime y package.
Comience con cinco fallos representativos, luego amplíe a sistemas principales y regresiones.
Proporciona solo el contexto relevante y autorizado y mide la recuperación por separado.
No. Repite tareas, conserva los fallos, prueba la recuperación y mide el esfuerzo del revisor.
Puede proporcionar un objetivo de prototipo en el navegador mientras la puntuación nativa permanece en Unreal.
Genera un juego nativo de Unreal 5 en SEELE AI, revisa la vista previa en el navegador, luego optimiza, empaqueta, descarga o publica el juego. Mantén las licencias, las pruebas de plataforma objetivo y las afirmaciones de modelos de terceros como puertas de verificación separadas.
La descarga de pago es opcional para las salidas elegibles de SEELE AI. La disponibilidad, la demanda y los ingresos no están garantizados.