OCTOPUSAINEWS

ByteDance lança SeedRealtime para conversação multimodal

A ByteDance apresentou o SeedRealtime, modelo de linguagem nativo audiovisual com capacidade de processamento full-duplex em tempo real.

05 de ago., 23:30 3 fontes · 2 países Modelos
ModelosByteDance
Representação gráfica de uma rede neural em tons azulados. Foto: Google DeepMind / Pexels

A ByteDance anunciou o lançamento do SeedRealtime, um modelo de linguagem (LLM) que processa entradas de áudio e vídeo de forma simultânea e nativa. A tecnologia permite interações full-duplex, possibilitando conversas contínuas entre humanos e máquinas sem a necessidade de turnos fixos de fala.

Arquitetura e funcionamento

Diferente de assistentes de voz convencionais que dependem de etapas separadas de reconhecimento de fala, processamento de linguagem e conversão de texto, o SeedRealtime integra todos esses fluxos em um único sistema multimodal. Essa arquitetura nativa diminui a latência e permite que a inteligência artificial entenda o contexto visual enquanto ouve e responde.

O sistema possui a capacidade de identificar interrupções durante o diálogo, permitindo que o usuário corte a fala do modelo e altere o rumo da conversa instantaneamente. O modelo processa as informações continuamente, adaptando a resposta de forma dinâmica, o que busca simular um fluxo de fala mais próximo ao humano.

Óculos inteligentes exibindo interface de dados digitais.
Foto: Vika Glitter / Pexels

Aplicações e mercado

A tecnologia foi desenvolvida pela equipe de pesquisa Seed da ByteDance e divulgada em 5 de agosto. A empresa aponta que a integração de visão e voz é voltada para dispositivos que demandam respostas rápidas e compreensão do ambiente, como:

A novidade coloca a ByteDance no mercado de sistemas conversacionais avançados, competindo com desenvolvimentos recentes de empresas como OpenAI, Google e Anthropic, que também priorizam a redução de latência e a naturalidade nas interações multimodais.

O que ainda não foi divulgado

Apurado em 3 fontes

DIGITIMES (Taiwan) · Lapaas Voice (Índia) · Lapaas Voice (Índia) · Lapaas Voice (Índia) · Lapaas Voice (Índia) · Lapaas Voice (Índia) · Lapaas Voice (Índia) · Lapaas Voice (Índia)

receba antes

O mundo publica sobre IA em 167 idiomas. A gente lê por você.

Grátis: o resumo da semana no e-mail ou no WhatsApp. Cancela com 1 clique.

Assinar grátis
quer o radar inteiro?

Grátis — todas as notícias de IA do mundo, e a sua newsletter do seu jeito: seus temas, sua hora.

Abrir o OCTOPUS →