UniRL é uma estrutura para Aprendizado por Reforço de Modelo Multimodal Unificado
Treine e melhore modelos de IA multimodal usando um framework unificado para aprendizado por reforço.
Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.
Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.
Grátis · sem cartão · cancele quando quiserUniRL é uma estrutura para Aprendizado por Reforço de Modelo Multimodal Unificado
UniRL tem 860 estrelas no GitHub. Foi bifurcado 56 vezes. UniRL é escrito principalmente em Python. Está em desenvolvimento ativo desde 2026. Os seus principais temas são: ai-infrastructure, reinforcement-learning, sglang, vllm.
UniRL é uma estrutura para Aprendizado por Reforço de Modelo Multimodal Unificado
UniRL é um projeto de código aberto.
Sim. UniRL é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.
UniRL é escrito principalmente em Python.
Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.
[](https://opensourceai.tech/project/tencent-hunyuan-unirl.html)
Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.