Em Alta Eleições 2026 PolíticaNotíciasAcontecimentos internacionaisPessoasConflitoseconomiaFutebol

Converse com o Telinha

Telinha
Oi! Posso responder perguntas apenas com base nesta matéria. O que você quer saber?

Novo método melhora planejamento de tarefas visuais complexas

Sistema híbrido de visão e planejamento gera planos de longo alcance a partir de uma imagem, com setenta por cento de sucesso e capacidade de generalizar a problemas não vistos

A new AI-driven system generates plans for long-term, complex tasks about twice as well as some existing methods. Researchers evaluated their system by seeing how well it could create plans to accomplish objectives in six 2D grid-worlds, like those shown here.
0:00
Carregando...
0:00

Um grupo de pesquisadores do MIT apresentou uma abordagem híbrida baseada em IA generativa para planejar tarefas visuais de longo prazo, como navegação de robôs. O método combina modelos de visão e linguagem para interpretar cenas e simular ações.

A segunda etapa transforma essas simulações em arquivos de definição de domínio e problema na linguagem de planejamento PDDL. Um solucionador clássico gera o plano passo a passo, com refinamento via comparação com a simulação.

O sistema, denominado VLMFP, utiliza dois modelos especializados. SimVLM descreve a cena e simula ações; GenVLM produz arquivos PDDL a partir dessas descrições e é refinado pelo simulador.

Segundo os pesquisadores, o VLMFP obteve taxa de sucesso média de cerca de 70% em planos longos, o que supera as melhores técnicas de referência, em torno de 30%.

Resultados mostram boa capacidade de generalização para problemas não vistos previamente, incluindo ambientes com mudanças súbitas e tarefas de cooperação multirobot.

Desempenho e aplicações

Em tarefas 2D, o VLMFP alcançou cerca de 60% de sucesso; em cenários 3D, passou de 80%, com planos válidos em mais de 50% dos casos não vistos.

Os autores destacam que o sistema pode se adaptar a novos problemas mantendo o domínio estável, graças à separação entre descrição da cena e plano de ação.

O trabalho foi apresentado na conferência internacional sobre Representações de Aprendizado (ICLR) e financiado, parcialmente, pelo MIT-IBM Watson AI Lab.

Comentários 0

Entre na conversa da comunidade

Os comentários não representam a opinião do Portal Tela; a responsabilidade é do autor da mensagem. Conecte-se para comentar

Veja Mais