Categoria: Engenharia de processamento de linguagem

InnAIO lança gravador de áudio com IA na França

A InnAIO lança dois produtos: o gravador de áudio com IA TransNote e o porta-retratos inteligente Vi...

2026-06-12

Grupo OVH, da França, planeja adquirir a empresa de IA de voz Gladia

O Grupo OVH (OVH Groupe) anunciou a entrada em negociações exclusivas para adquirir a Gladia, empres...

2026-06-12

Google dos EUA lança modelo de tradução de voz em tempo real Gemini 3.5

No dia 9 de junho, a Google dos EUA anunciou o lançamento do modelo de tradução de voz em tempo real...

2026-06-10

Microsoft dos EUA lança API de reconhecimento de fala no Windows e modelos de linguagem pequenos Aion

De 2 a 3 de junho, a Microsoft dos EUA anunciou atualizações nas Windows AI APIs durante a Build 202...

2026-06-04

Google lança recurso de deteção de chamadas falsas para Android que identifica fraudes com clonagem de voz por IA

A Google lançou um recurso de deteção de chamadas falsas para o sistema Android, com o objetivo de c...

2026-06-04

AethexAI, dos EUA, levanta 3 milhões de dólares e mira IA de voz na África e Oriente Médio

A AethexAI é uma startup focada na construção de produtos de IA de voz para os mercados da África e ...

2026-06-04

JD.com da China lança framework de geração de áudio e vídeo longo JoyAI-Echo como código aberto

Em 3 de junho, a JD.com lançou o framework de geração de áudio e vídeo longo JoyAI-Echo, com código ...

2026-06-04

Deepgram, em parceria com Fortanix e NVIDIA, direciona IA de voz local para implantação de computação confidencial

Recentemente, a empresa americana de infraestrutura de IA de voz em tempo real Deepgram firmou uma p...

2026-06-03

MAI-Transcribe-1.5 da Microsoft EUA integrado ao Foundry: modelo de transcrição com 43 idiomas completa o fluxo de trabalho de IA de voz

Em 2 de junho, durante a Build 2026, a Microsoft dos EUA apresentou novos membros da família de mode...

2026-06-03

A Soul App da China lança o SoulX-Transcriber como código aberto, um modelo de transcrição de conversas com múltiplos falantes que integra identificação de falante, carimbo de data/hora e reconhecimento de texto

Em 3 de junho, a equipe de IA da Soul App (Soul AI Lab), em colaboração com o grupo de pesquisa ASLP...

2026-06-03

Tencent Cloud, da China, e Soniox, dos EUA, colaboram para impulsionar IA de voz multilíngue

A Tencent Cloud firmou uma parceria estratégica com a Soniox, empresa de IA de voz sediada em São Fr...

2026-06-03

NTT do Japão lança estrutura de raciocínio de IA explicável multimodal, modelos de linguagem visual entram na fase de calibração de saída confiável

A NTT do Japão anunciou recentemente o estabelecimento da estrutura de raciocínio de IA explicável m...

2026-06-02

Tencent Cloud da China une-se à Soniox dos EUA para integrar transcrição de voz em tempo real à infraestrutura global de comunicações

A Tencent Cloud da China firmou recentemente uma parceria estratégica com a Soniox, empresa de IA de...

2026-06-02

MiniMax, da China, lança modelo M3 com contexto de milhões, impulsionando a competição de IA para agentes de tarefas longas

Em 1º de junho, a empresa chinesa de Inteligência Artificial MiniMax lançou seu novo modelo de uso g...

2026-06-02

T-Mobile dos EUA lança serviço de tradução em tempo real com IA integrada à rede, rumo à conectividade inteligente

A T-Mobile US lançou uma importante atualização para a infraestrutura de sua rede sem fio, apresenta...

2026-05-26

API DeepSeek-V4-Pro da China ajustada para 1/4 do preço original, estratégia de preços baixos de longo prazo reduz custos de chamada de modelos grandes

Em 22 de maio, a página oficial de preços da DeepSeek mostrou que o preço da API do modelo DeepSeek-...

2026-05-23

Yuanbao da Tencent na China é atualizado novamente, adicionando resumo e análise inteligentes de registros de conversas do WeChat

O assistente de IA Yuanbao, da Tencent, anunciou em 13 de maio a conclusão de uma atualização de fun...

2026-05-15

O Alibaba Qianwen da China lança entrada de voz por IA no PC, com funcionalidades de assistente inteligente entre aplicações totalmente abertas

O produto de modelo de grande escala do Grupo Alibaba, "Alibaba Qianwen", lançou oficialmente a func...

2026-05-07

A Rede Nacional de Supercomputação da China lança o serviço gratuito por tempo limitado de diálogo com o DeepSeek-V4, com milhões de tokens de contexto gratuitos

A plataforma da Rede Nacional de Supercomputação da China lançou oficialmente, em 26 de abril, o ser...

2026-04-27

Preço do cache de entrada da API DeepSeek cai para um décimo do preço de lançamento, V4-Pro com oferta limitada a 0,025 yuans por milhão de tokens

A DeepSeek anunciou em 26 de abril um reajuste nos preços da API. O preço do cache de entrada com ac...

2026-04-27

DeepSeek-V4 é lançado com contexto de 1M e capacidades agentivas equivalentes aos modelos fechados globais de ponta

A DeepSeek lançou oficialmente, em 24 de abril, a nova série de modelos DeepSeek-V4 Preview e, simul...

2026-04-24

A xAI lança oficialmente as APIs de Fala para Texto e Texto para Fala do Grok, com processamento em lote de STT a US$ 0,10 por hora

A xAI anunciou oficialmente, em 17 de abril (horário local), o lançamento das APIs de Fala para Text...

2026-04-18

Oracle lança nos EUA busca por respostas confiáveis, usando tecnologia de vetores em vez de LLMs para pesquisa semântica

A Oracle lançou recentemente uma nova tecnologia chamada Busca por Respostas Confiáveis (Trusted Ans...

2026-04-18

ByteDance Lança Modelo de Voz Full-Duplex Seeduplex no App Doubao

A ByteDance lançou em 9 de abril o modelo de voz de grande porte (LLM) nativo full-duplex Seeduplex,...

2026-04-09