Implantação de Cluster Elasticsearch e Balanceamento de Carga com Docker e Nginx
Preparação do Ambiente Docker
Para iniciar a configuração, é necessário garantir que o Docker esteja instalado e atualizado no sistema operacional. O processo abaixo utiliza o gerenciador de pacotes YUM para ambientes baseados em RedHat/CentOS.
# Atualizar repositórios e instalar Docker
sudo yum update -y
sudo yum remove docker-ce -y
sudo yum i ...
Publicado em 8-11 22:46
Implementação de Motor de Busca e Análise de Similaridade com Elasticsearch e Python
Arquitetura do Sistema de Recuperação de Informação
A construção de um motor de busca robusto exige a integração de indexação eficiente, recuperação de texto completo e análise estatística de documentos. O sistema descrito neste artigo é projetado para processar grandes volumes de textos em múltiplos idiomas, oferecendo três capacidades fundame ...
Publicado em 8-10 23:35
Configurando o Elasticsearch em Ambientes Linux
A instalação e configuração do Elasticsearch em sistemas operacionais baseados em Linux requerem uma série de passos, desde a preparação do ambiente até os ajustes finos dos parâmetros do serviço. É fundamental que o Java Development Kit (JDK) versão 8 ou supeiror esteja previamente instalado e configurado no sistema para que o Elasticsearch fu ...
Publicado em 7-28 23:18
Usando o Elasticsearch.Net como Cliente do Elasticsearch
https://github.com/elastic/elasticsearch-net
Escolha Elasticsearch.Net como cliente
Forma de conexão
var node = new Uri("http://myserver:9200");
var config = new ConnectionConfiguration(node);
var client = new ElasticLowLevelClient(config);
var meuJson = @"{ ""hello"" : ""world"" }" ...
Publicado em 7-27 21:47
Gerenciamento de Acesso e Bloqueio de Portas com iptables no Linux
Operações Básicas de Bloqueio
Para bloquear todo o tráfego proveniente de um endereço IP específico:
iptables -A INPUT -s 192.168.10.5 -j DROP
Para restringir o acesso a uma porta única (exemplo: banco de dados na porta 3306):
iptables -A INPUT -s 192.168.10.5 -p tcp --dport 3306 -j DROP
Para bloquear o acesso a um conjunto de portas simultan ...
Publicado em 7-26 08:00
Gerenciando a Configuração do Filebeat: Erros Comuns e Soluções
A configuração inadequada do Filebeat pode levar a problemas de duplicação de logs e falhas na saída de dados. Este artigo aborda dois cenários comuns e suas respectivas correções.
Cenário 1: Procsesos Filebeat Múltiplos Devido à Configuração do Supervisor
Sintoma: Monitoramento de Elasticsearch indicando um aumento incomum no volume de requisi ...
Publicado em 7-15 01:13
kibana-time-plugin: Aprimorando o Controle e a Animação de Dados Temporais no Kibana
Introdução ao kibana-time-plugin
O Kibana, uma ferramenta de visualização fundamental para o Elasticsearch, é amplamente utilizado em cenários de big data e monitoramento em tempo real. No entanto, a manipulação e exploração de dimensões temporais dos dados pode ser aprimorada para oferecer maior flexibilidade e precisão. O kibana-time-plugin s ...
Publicado em 7-13 21:04
Atualização Eficiente de Documentos em Massa no Elasticsearch com Scripts em .NET Core
Lidar com a necessidade de atualizar grandes volumes de dados no Elasticsearch pode ser um desafio de desempenho, especialmente quando as atualizações não são pontuais e afetam milhões de documentos. Uma abordagem comum, como recuperar documentos via cursor ou paginação e depois atualizá-los individualmente ou em pequenos lotes, torna-se inviáv ...
Publicado em 7-10 17:32
Realce de Resultados de Busca no Elasticsearch
Preparando os Dados
Antes de explorar o recurso de realce, vamos criar um documento de exemplo no índice pessoas:
PUT pessoas/registro/10
{
"nome": "Pedro",
"idade": 34,
"origem": "brasil",
"biografia": "programador dedicado e curioso",
"etiquetas": [" ...
Publicado em 7-8 16:38
Estratégia best_fields no Elasticsearch: dis_max, tie_breaker e minimum_should_match
Quando fazemos uma busca full-text sobre vários campos, o comportamento padrão do bool com should pode devolver documentos que combinam com muitos campos, mas com poucas palavras-chave em cada um, à frente de documentos onde um único campo concentra a maior parte dos termos. Para priorizar o docuemnto em que um campo específico acumula mais ter ...
Publicado em 7-6 21:36