GPU-CFR, el algoritmo de Tsinghua que acelera 80 veces el entrenamiento de agentes
Un paper de Tsinghua describe GPU-CFR, que compila juegos de información imperfecta a dataflow estático y CUDA Graph Replay para acelerar hasta 80 veces el entrenamiento de agentes estratégicos.