SpeakerMem-R1: memória dual para diálogos em grupo com atribuição
Sistema de memória em dois trilhos preserva mensagens verbatim e estados derivados por pessoa e por grupo, com foco em atribuição de fala.
Ler artigoSistema de memória em dois trilhos preserva mensagens verbatim e estados derivados por pessoa e por grupo, com foco em atribuição de fala.
Ler artigoPesquisa propõe o Taste-Bench para medir, sem anotação especialista, se agentes escolhem o melhor caminho em bifurcações de tarefas longas.
Ler artigoPaper propõe WROP, benchmark e corpus de 1,5 milhão de clipes em Blender para treinar permanência de objeto e solidez em modelos de vídeo.
Ler artigoPaper propõe família aberta de modelos (4B, 9B, 27B) treinada em quatro capacidades pedagógicas e mostra ganhos em currículo, resolução e tutoria.
Ler artigoAnt Group apresenta dois modelos de 9B que unem percepção contínua, fala nativa e execução assíncrona de tarefas em diálogo full-duplex.
Ler artigoPesquisadores propõem regularizar a evolução automática de harnesses de agentes para conter overfitting e melhorar generalização.
Ler artigoModelo MoE multimodal de 552B parâmetros comprime o KV cache global para 890 bytes por token via CSA2 e FP4, segundo os autores.
Ler artigoNova geração da família LimiX troca a previsão de um alvo pela modelagem conjunta das variáveis e supera modelos tabulares em três benchmarks.
Ler artigoCombinar âncoras de dados, função e peso com LoRA mesclado eleva a retenção de 1,2% para 34,9% em 100 tarefas sequenciais.
Ler artigoPaper apresenta modelo denso de 7,39B parâmetros, treinado do zero, que combina atenção híbrida, FP8 Muon e uso ativo de ferramentas.
Ler artigoPaper apresenta Vidu S2-Avatar, que gera personagens digitais a 720p em tempo real, e Vidu S2-Editing, que edita fluxo de vídeo ao vivo.
Ler artigoTrocar a API paga por um modelo self-hosted num agente multimodal parece só mudar a URL. Três coisas quebram antes de o agente ficar de pé.
Ler artigoPedir que o modelo raciocine em etapas virou conselho universal. A pesquisa mostra quando ajuda, quando derruba o desempenho e quanto custa.
Ler artigoLangChain e LangGraph chegaram ao 1.0 em outubro de 2025 e o framework virou harness de agente sobre o runtime do LangGraph.
Ler artigoModelo agêntico de 744B parâmetros treinado com experiências verificáveis; autores relatam liderança em 5 de 16 benchmarks e papéis humano-IA.
Ler artigoRyu, Kim e Yang propõem o SpatialBlock-15k, dataset sintético de empilhamento de blocos que melhora a inteligência espacial de LVLMs sem anotação 3...
Ler artigoHarness model-agnostic converte VLMs em agentes robóticos via ações semânticas discretas, com controle zero-shot e adaptação leve.
Ler artigoModelo de 8B unifica compreensão, raciocínio e geração de imagens no espaço de pixels, sem encoder visual nem VAE, com saída até 4K.
Ler artigoModelo latente de 8,9B parâmetros une predição de tokens e de conceitos e atinge a perda do OLMo-3-7B usando 51,3% dos tokens.
Ler artigoRelatório técnico do AuK propõe um modelo fundamental aberto que trata geração e edição de fala como uma só tarefa, guiada por instruções.
Ler artigoEscolas, periódicos e editoras passaram a usar detectores de texto gerado por inteligência artificial como prova de autoria, mas a evidência...
Ler artigoEquipe NeoHorse propõe pós-treino agêntico com roteamento e currículo que eleva média macro de 4B de 58,94 para 64,87 em 11 benchmarks.
Ler artigoAutores propõem substituir a execução real por um world model no RL e corrigir viés e ruído com debiasing online e denoising por variância inversa.
Ler artigoDescubra o que são prompts de IA, como funcionam e as vantagens de usá-los. Aprenda técnicas práticas para criar prompts eficazes.
Ler artigoDescubra o que é GPU e sua importância na tecnologia atual, especialmente no desenvolvimento de soluções de inteligência artificial eficazes.
Ler artigoDescubra o que é Langchain, seus conceitos básicos e como funciona. Aprenda sobre suas aplicações, benefícios e como ele pode transformar a automação.
Ler artigoNeste artigo exploramos as tendências da inteligência artificial em 2025 para negócios e organizações.
Ler artigo