Últimas Notícias IA
Artigos IA
Tópicos
Módulos
Modelos de IA
Serviços
Tudo Sobre Multimodal
Início
Tópicos
Multimodal
Notícia
Engram: sampler com IA transforma alucinações em música
Notícia
Synthesia cria gêmeo digital de jornalista e testa avatar interativo
Notícia
AWS mostra treino de RL multimodal com SkyRL no HyperPod
Notícia
Meta abre acesso antecipado aos novos recursos do Muse
Artigo
WROP: ensinar permanência de objeto a modelos de mundo em vídeo
Notícia
Apple Intelligence chega às câmeras: teste compara Ring e Nest
Notícia
WhisperX da AWS chega ao SageMaker AI com transcrição por falante
Notícia
Google lança Gemini 3.8 Live com avatar em vídeo em tempo real
Notícia
Google cria co-diretor de IA para vídeos longos coerentes
Notícia
Gemini 3.8 Live ganha avatar com rosto e sincronia labial
Notícia
Liquid AI lança DSpark para acelerar modelo de visão e linguagem
Notícia
Meta apresenta Muse Charm, aparelho dedicado ao agente de IA Muse
Notícia
Meta aposta tudo no agente Muse e leva IA aos óculos no Connect
Artigo
Realtime-Venus: diálogo full-duplex com delegação assíncrona
Notícia
NVIDIA apresenta Nemotron 3 para diarização em tempo real
Artigo
DeepSeek-V4.1-Flash: compressão radical de KV cache
Notícia
Google Flow leva IA aos bastidores da New York Fashion Week
Notícia
Kimi K3 chega ao Amazon Bedrock com 2,8 trilhões de parâmetros
Notícia
Pelicano de Roger Rabbit: cena híbrida une animação e bicicleta real
Notícia
Filme da Odisseia feito só com IA é criticado por duração e qualidade
Notícia
Snap lança Specs Intelligence, IA que chega ao iOS e ao Mac
Notícia
Snap reforça aposta nos óculos Specs de US$ 2.200 com IA
Notícia
Meta prepara óculos sem câmera após acusações de 'perv glasses'
Artigo
Vidu S2: vídeo interativo em tempo real, editável e espacial
Artigo
Modelos self-hosted em agentes multimodais: três armadilhas que a documentação não conta
Notícia
Google lança Gemini 3.8 Live e Willison cria interface de voz
Notícia
Google lança Gemini 3.8 Live com voz e raciocínio paralelo
Notícia
OpenAI adquire Glass Imaging por US$ 300 milhões, diz WSJ
Artigo
SpatialBlock: blocos sintéticos ensinam LVLMs a raciocinar em 3D
Artigo
Show-Harness: VLMs que pilotam robôs por ações semânticas
Artigo
SenseNova-U1.5: IA visual unificada sem encoder nem VAE
Artigo
AuK: modelo aberto unifica geração e edição de fala
Notícia
OpenRouter: roteamento automático pode gerar respostas inconsistentes
Notícia
DeepMind usa IA para recriar memória de casal em curta