

Loading comments…
Informações do projeto
Palavras-chave do produto
O NVIDIA PersonaPlex é um modelo de IA conversacional full-duplex que permite conversas naturais em tempo real com vozes e papéis personalizáveis. Ao contrário dos sistemas tradicionais em cascata (ASR→LLM→TTS), que parecem robóticos com pausas estranhas, ou dos modelos full-duplex que te prendem a uma única voz, o PersonaPlex combina dinâmicas naturais de conversa com flexibilidade de persona. Ele ouve e fala simultaneamente, lidando com interrupções, sinais de retorno e trocas de turno autênticas, enquanto mantém qualquer persona escolhida definida por meio de prompts de texto.
O PersonaPlex ouve e fala simultaneamente, atualizando seu estado interno enquanto o usuário fala e transmitindo uma resposta de volta imediatamente. Isso elimina os atrasos dos sistemas em cascata e recria sinais humanos, como pausas, interrupções e sons de retorno como "uh-huh" ou "aham".
Selecione entre uma variedade de vozes e defina qualquer papel por meio de prompts de texto — seja um assistente sábio, um agente de atendimento ao cliente ou um personagem de fantasia. O modelo mantém a persona escolhida durante toda a conversa, superando os sistemas existentes na adesão à tarefa.
O PersonaPlex demonstra forte capacidade de seguir instruções a partir de prompts de texto, como mostrado em exemplos de atendimento ao cliente, onde ele verifica identidades, registra detalhes de pacientes e garante confidencialidade. Ele também transmite empatia e trocas de turno naturais, mesmo enquanto ouve e fala simultaneamente.
Usando prompts de voz, o PersonaPlex pode controlar sotaques, adicionando outra camada de personalização para casos de uso diversos, como atendimento ao cliente regional ou interações multilíngues.
"Pela primeira vez, você obtém tanto a personalização necessária quanto a naturalidade que torna as conversas genuinamente humanas."
Esta frase resume o avanço do PersonaPlex: quebrar a troca entre flexibilidade de persona e naturalidade conversacional. Enquanto modelos full-duplex anteriores, como o Moshi, ofereciam interação natural, mas te prendiam a uma voz e papel fixos, o PersonaPlex permite que você defina qualquer persona por meio de prompts de texto, mantendo a capacidade de ouvir, falar e lidar com interrupções em tempo real. O resultado é um modelo que não apenas segue instruções, mas também recria os sinais não verbais que os humanos usam para interpretar intenções e emoções.
Você está construindo aplicações de IA conversacional que exigem tanto interação natural quanto personalização de persona — como agentes de atendimento ao cliente, assistentes virtuais ou personagens interativos. O PersonaPlex é especialmente relevante se você já enfrentou a sensação robótica dos sistemas em cascata ou a inflexibilidade dos modelos full-duplex existentes. Também vale a pena explorar para pesquisas sobre dinâmicas conversacionais, pois ele supera os sistemas existentes no tratamento de interrupções, sinais de retorno e adesão à tarefa.
Outras ferramentas que você pode considerar
Fale naturalmente, e o Typeless para iOS transformará sua fala em mensagens, e-mails e documentos claros e refinados que parecem ter sido digitados por você com cuidado - em tempo real. De repente, seu iPhone pode fazer coisas que antes pareciam impossíveis, sem esforço e 10 vezes mais rápido.
O Okara permite que você utilize mais de 30 modelos de IA open-source poderosos sem se preocupar com a configuração de infraestrutura. Os melhores modelos, como Kimi e DeepSeek, são grandes demais para rodar no seu notebook — nós cuidamos disso para você. Alterne entre modelos, pesquise no Google, Reddit, X, YouTube diretamente nos seus chats, analise arquivos, gere imagens e trabalhe em equipe. Tudo é criptografado e nunca treinamos com seus dados.
TranslateGemma é uma nova suíte de modelos de tradução de IA abertos, construída sobre o Gemma 3 do Google. Ela possibilita uma comunicação de alta qualidade em 55 idiomas, combinando forte precisão com eficiência excepcional. Projetada para rodar em dispositivos móveis, locais e ambientes em nuvem sem comprometer o desempenho.
Mistral 3 inclui três modelos pequenos e densos de última geração (14B, 8B e 3B) e o Mistral Large 3 – nosso modelo mais capaz até o momento – um modelo esparso de mistura de especialistas treinado com 41B de parâmetros ativos e 675B de parâmetros totais. Todos os modelos são lançados sob a licença Apache 2.0. Os modelos Ministral representam a melhor relação custo-desempenho em sua categoria. Ao mesmo tempo, o Mistral Large 3 se junta ao seleto grupo de modelos de código aberto de fronteira com ajuste fino instrucional.
Criador
mocha_byte
Loading comments…