

dtSearch anunciou uma versão 2026.01 beta que simplifica a forma como os usuários veem os resultados de pesquisa destacados em arquivos PDF. A nova versão elimina a necessidade de um plug-in de marcador de PDF separado, uma mudança que se aplica aos produtos empresariais e de desenvolvedor dtSearch, incluindo SDKs para Home windows, Linux e macOS. Esses produtos pesquisam instantaneamente terabytes de dados mistos on-line e off-line, executados no native ou na nuvem, como no Azure ou AWS.
A principal característica da nova versão é o destaque aprimorado de ocorrências em PDF. O novo processo destaca os resultados da pesquisa adicionando anotações diretamente ao arquivo PDF. Isso significa que os arquivos PDF agora funcionam como outros tipos de dados suportados, como arquivos do Microsoft Workplace e e-mails com anexos, exibindo arquivos com destaque multicolorido para qualquer número de usuários simultâneos.
O proprietário do dtSearch, David Thede, disse ao SD Occasions em uma entrevista que a antiga abordagem de usar um plug-in Adobe Acrobat Reader tornou-se cada vez mais insustentável em um ambiente de navegador. O novo método oferece uma maneira muito mais limpa para as pessoas adicionarem destaques de PDF em seus aplicativos. Thede explicou como o sistema mudou: “A chave para conseguir esse trabalho é que precisávamos ser capazes de adicionar os destaques como anotações no arquivo pdf, então, em vez de gerar html a partir do pdf, pegamos um pdf existente e colamos as anotações nele, e depois o veiculamos.”
Na nova versão, o dtSearch tem uma maneira de trabalhar com navegadores que usam o projeto pdf.js de código aberto, disse Thede. O navegador Firefox, como muitos navegadores, possui visualizadores de PDF baseados em JavaScript baseados nesse projeto. “Então, em nosso produto de desktop dtSearch podemos incorporar uma janela de visualização que tenha pdf.js usado para exibir o arquivo pdf. Podemos fazer a navegação e o destaque dos hits além disso, mas também podemos fazer isso em nossos produtos baseados na net.”
Os produtos dtSearch incluem um indexador de terabyte que pode indexar um terabyte de texto em muitas fontes, incluindo e-mails com anexos aninhados e dados on-line. A pesquisa indexada normalmente é instantânea, mesmo quando cobre terabytes de dados com usuários simultâneos. A linha de produtos oferece mais de 25 recursos de pesquisa, incluindo opções de texto completo e metadados. Ele oferece suporte a Unicode para centenas de idiomas internacionais e oferece opções voltadas para análise forense. Os SDKs estão disponíveis para APIs C++, Java e .NET e oferecem suporte a bancos de dados como SQL e NoSQL.
Thede enfatizou o valor do novo recurso PDF. Ele disse: “Ser capaz de destacar ocorrências em arquivos PDF após uma pesquisa é uma coisa muito boa de se fazer, porque o PDF é muito usado”. Ele observou que isso economiza muito tempo para profissionais, como advogados que analisam documentos longos1
Em relação à integração de IA, Thede confirmou que o dtSearch não inclui IA em seus produtos. Ele observou que esta decisão está ligada a preocupações de segurança do cliente: “Nossos clientes são geralmente instituições que estão extremamente preocupadas com a confidencialidade”. No entanto, Thede acrescentou que a dtSearch planeja procurar maneiras de fornecer aos usuários as ferramentas para conectar seus resultados de pesquisa com IA quando assim decidirem.