
Black Forest Labs (BFL) está expandindo sua família FLUX além da geração de imagens com o lançamento de hoje do FLUX 3, um modelo de fronteira multimodal treinado para compreender e gerar imagens ou combinar clipes de áudio/vídeo de até 20 segundos a partir de um único prompt – e para estender a mesma arquitetura subjacente à visão e ações robóticas.
O laboratório de IA com sede em Freiburg, na Alemanha, afirma que o FLUX 3 e treinado em conjunto nessas modalidades, em vez de montar modelos separados de imagem, vídeo e áudio por trás de uma interface comum. Essa distinção é central para a proposta da empresa: a BFL quer que as empresas pensem na geração criativa, simulação, uso de computadores e robótica como aplicações conectadas de uma única capacidade que chama de inteligência visual – modelos, nas palavras da empresa, “que podem perceber, prever e agir em ambientes físicos e digitais”.
Este lançamento marca o primeiro modelo de geração de vídeo público da BFL. O FLUX 3 será oferecido através de quatro linhas de produtos: FLUX 3 Video, FLUX 3 Image, FLUX 3 Action e o próximo, aberto
Fonte original:
Black Forest Labs launches FLUX 3 capable of generating images and 20-second video with audio — but in limited release to start
Categorias: Ciência e Tecnologia, IA
Marcador: Notícias
ARNews Notícias. Preenchendo a necessidade de informações confiáveis. Todos os direitos reservados.
Traduzido por AI