Artículo

08 de octubre de 2026

Transformação de Dados Transacionais em Inteligência de Negócio: Framework de “Data Wrangling” e “Dashboards”

Transformação de Dados Transacionais em Inteligência de Negócio: Framework de “Data Wrangling” e “Dashboards”

Kurt Roland Windisch; Jacques Henrique Dias

DOI: 10.22167/2675-6528-202603115

Artigo derivado de Trabalho de Conclusão de Curso (TCC), com conteúdo baseado no trabalho original do aluno e adaptado ao formato editorial da Revista E&S com apoio da ferramenta ResumeAI, solução de inteligência artificial desenvolvida pelo Instituto Pecege para síntese e organização textual.

Resumo

A evolução das capacidades de captura e processamento de dados tornou imperativa a transformação de informações para tomada de decisão ágil e bem-informada. O estudo focou na aplicação de conhecimentos da ciência de dados para capturar, processar e manipular dados transacionais de um comércio britânico, visando facilitar a compreensão e a tomada de decisões sobre consumidores, produtos e vendas. Utilizou-se uma abordagem qualitativa do tipo pesquisa-ação, empregando dados transacionais de um varejo digital do Reino Unido. Os dados foram tratados em Python, aplicando técnicas de data wrangling, modelagem dimensional em esquema estrela e métodos estatísticos como Tuckey Fences (IQR) para normalização de preços. A segmentação de consumidores foi realizada por meio do algoritmo K-Means, considerando frequência e valor monetário. Os dados processados foram então carregados e visualizados em dashboards interativos no Power BI. Os resultados revelaram a identificação de diferentes perfis de consumidores, destacando a importância de clientes de alto valor e a oportunidade de crescimento em mercados específicos. Observaram-se tendências de vendas sazonais e anomalias em dados de produtos, evidenciando a necessidade de governança de dados. Concluiu-se que o framework desenvolvido permite transformar dados brutos em diagnósticos estratégicos, promovendo a maturidade digital e a tomada de decisão baseada em dados.

Palavras-chave: Clustering; Dashboards; Data Wrangling; Power BI.

1. Introdução

A revolução dos dados tem transformado o cenário empresarial, tornando os empreendimentos cada vez mais dependentes de informações para suas operações e estratégias. Este fenômeno é parte integrante da quarta revolução industrial, caracterizada por avanços computacionais que possibilitam a automação, a criação de fábricas inteligentes interconectadas e uma crescente dependência de dados internos e externos. Nesse contexto, a capacidade de análise e inteligência de dados, bem como a interação avançada entre humanos e máquinas, tornam-se cruciais (Marr, 2017).

Nesse ambiente dinâmico, empresas conectadas à internet geram volumes astronômicos de dados, e os modelos de negócios se renovam rapidamente. Surge, assim, a necessidade premente de não apenas capturar, limpar e analisar esses dados, mas também de interpretá-los e apresentá-los de forma compreensível. O objetivo é capacitar funcionários e a gestão a obter uma visão clara para agir, interagir e reagir ao comportamento dos clientes, utilizando as informações capturadas em suas interações.

A importância da tomada de decisão baseada em dados é corroborada por estudos que demonstram seus benefícios. Em 2012, uma pesquisa com 330 empresas públicas americanas revelou que companhias líderes em suas indústrias, ao adotarem decisões orientadas por dados, alcançaram uma produtividade 5% maior e uma rentabilidade 6% superior em comparação com seus concorrentes (McAfee et al., 2012). A relevância dos aspectos visuais na comunicação de informações complexas também é amplamente reconhecida, desde o ditado popular atribuído a Confúcio (Azevedo, 2021) até estudos focados em visualização de dados (Wexler et al., 2017). Ferramentas como os “dashboards” são essenciais nesse processo, pois permitem a apresentação interativa e intuitiva de informações, democratizando o acesso aos dados para os tomadores de decisão.

Contudo, apesar da abundância de dados e do reconhecimento de sua importância, ainda existe uma lacuna significativa na adoção de práticas eficazes de análise e governança de dados. Um estudo europeu de 2025 indicou que, mesmo em empresas consideradas digitalmente maduras, o uso de análise de dados é baixo, com médias de 14,5% para pequenas empresas, 33,8% para médias e 59,4% para grandes empresas (Bálint et al., 2025). Essa deficiência se estende à disponibilização de “dashboards” para uma tomada de decisão aprimorada. Além disso, a área de pesquisa que se concentra especificamente na visualização de dados para decisões estratégicas de gestão ainda é pouco explorada (Eberhard, 2021). Frequentemente, os dados transacionais brutos apresentam ruídos, inconsistências e falta de informações complementares, o que dificulta a extração de valor sem um tratamento adequado, conhecido como “data wrangling” (Kahn et al., 2024).

Diante desse cenário, torna-se fundamental desenvolver uma abordagem metódica para transformar dados brutos em inteligência de negócio acionável. Este estudo justifica-se pela necessidade de preencher a lacuna na adoção de práticas de análise de dados e visualização, oferecendo um framework que integra técnicas de ciência de dados, como o “data wrangling” para limpeza e tratamento, e o “clustering” (Ikotun et al., 2023) para segmentação de consumidores, culminando na criação de “dashboards” informativos. O objetivo final é conseguir demonstrar uma fundação metódica que inicia com dados transacionais brutos e aplicação de técnicas de ciência de dados se torna possível transformar dados poluídos transacionais em informações relevantes para tomada de decisão por meio de um dashboard com dados de consumidor, produto e vendas.

2. Material e Métodos

O presente estudo adotou uma natureza qualitativa, com abordagem de pesquisa-ação, focando na aplicação de conhecimentos da ciência de dados para transformar dados transacionais brutos em inteligência de negócio. A unidade de análise consistiu em um banco de dados público de varejo digital, proveniente de um comércio britânico. Os dados foram coletados de um repositório para “machine learning” da UC Irvine, conforme disponibilizado por Chen (2015), abrangendo o período de dezembro de 2010 a dezembro de 2011.

A metodologia geral seguiu os princípios de Extração, Transformação e Carregamento (ETL), conforme discutido por Kahn et al. (2024), com ênfase na etapa de transformação. Esta etapa envolveu a limpeza, padronização e conversão dos dados para garantir sua integridade e conformidade. O objetivo foi preparar os dados para serem carregados em ferramentas de Business Intelligence (BI), permitindo a construção de dashboards interativos e informativos.

Os dados transacionais originais apresentavam oito colunas, incluindo número da fatura, referência do produto, descrição do produto, quantidade, data da fatura, preço unitário, número do cliente e país do cliente. A manipulação e o tratamento desses dados foram realizados no ambiente de desenvolvimento integrado Spyder, utilizando a linguagem de programação Python. Este ambiente foi escolhido por sua capacidade de programação científica e manipulação de dados.

A etapa de limpeza e preparação dos dados iniciou com uma inspeção detalhada da base original. Identificou-se a ausência de identificação de consumidor em 135.081 linhas, as quais foram classificadas como “Visitante” para preservar o máximo de informações. Além disso, 10.625 linhas com quantidades negativas foram marcadas como “Retorno”, representando devoluções, e 2.516 linhas sem descrição, preço ou consumidor foram observadas, sendo consideradas para atualização de inventário sem uso analítico prático.

Procedeu-se à remoção de linhas anômalas que não possuíam preço, eram linhas de desconto não relacionadas a transações específicas, ou continham códigos de produtos não comerciais. Uma nova coluna, “Receita_por_Item”, foi adicionada, calculada pela multiplicação da quantidade unitária pelo preço unitário, resultando em uma tabela com 539.161 registros após a primeira fase de limpeza. As transações com quantidades negativas foram mantidas para análise posterior da receita bruta e taxa de retorno.

Para otimizar a análise e visualização, os dados foram remodelados em um esquema estrela, seguindo os princípios de modelagem dimensional descritos por Kirmani (2017). Esta estrutura separa os dados em uma tabela de fatos, contendo métricas quantitativas e mensuráveis, e tabelas de dimensão, que fornecem contexto descritivo. A tabela de transações originais foi mantida como a tabela de fatos, preservando a granularidade dos registros de linha de fatura.

Duas tabelas dimensionais principais foram criadas: “dim_produto” e “dim_consumidor”. A “dim_produto” consolidou informações sobre os produtos vendidos, incluindo código, descrição, quantidade total vendida, receita total por produto, contagem de faturas, número de consumidores e preço médio. A “dim_consumidor” agrupou dados relevantes do cliente, como quantidade comprada, receita total, número de transações, média de preço pago, valor médio por transação, valor monetário, frequência de compras e datas da primeira e última compra.

Devido a discrepâncias observadas entre o preço médio calculado e os preços unitários originais, aplicou-se o método estatístico Tuckey Fences, ou Intervalo Interquartil (IQR), para normalização de preços. Esta técnica, proposta por Tuckey (1977), foi utilizada para identificar e mitigar a influência de valores anômalos (“outliers”). O IQR foi calculado como a diferença entre o terceiro e o primeiro quartil, e os limites superior e inferior foram definidos por Q1 – (1.5 * IQR) e Q3 + (1.5 * IQR), respectivamente. Este procedimento foi implementado em Python, utilizando a biblioteca “numpy”, para criar uma coluna “Preço_Tabela” com preços ajustados para cada produto.

A segmentação de consumidores foi realizada utilizando o algoritmo K-Means, uma técnica de agrupamento não supervisionada, conforme descrito por Ikotun et al. (2023). Devido à limitação temporal dos dados (um ano), a segmentação focou nas dimensões de frequência de compra e valor monetário, adaptando a metodologia RFM (Recência, Frequência, Valor Monetário) mencionada por Handojo (2023). O número ideal de clusters (k) para cada variável foi determinado pelo método do cotovelo, que analisou a soma dos quadrados intragrupos, indicando três clusters para a frequência de compras e três para o total de vendas.

Após o processamento e a modelagem, as tabelas de fatos e dimensões foram carregadas no Power BI para a construção dos dashboards. Durante o carregamento, foram realizados ajustes como a formatação das datas para exibição curta. Para otimizar o modelo em esquema estrela e resolver a redundância da dimensão País, uma nova tabela dimensional, “Dim_País”, foi criada. Adicionalmente, uma “Tabela_Calendario” foi desenvolvida para centralizar filtros e cálculos temporais, facilitando a segmentação e a análise temporal dos dados no ambiente de visualização.

3. Resultados e Discussão

A análise dos dados transacionais de um comércio britânico revelou um panorama detalhado sobre o comportamento de consumidores, desempenho de produtos e tendências de vendas, permitindo a transformação de dados brutos em inteligência de negócio acionável. O estudo demonstrou que, por meio da aplicação de técnicas de ciência de dados, é possível gerar diagnósticos estratégicos que apoiam a tomada de decisão. A abordagem metodológica incluiu etapas de limpeza, transformação e modelagem de dados, culminando na criação de dashboards interativos, conforme o objetivo de fornecer uma fundação metódica para a análise de dados de varejo.

Inicialmente, identificou-se uma receita bruta total de £8,86 milhões, distribuída em 21,9 mil faturas, com um ticket médio por fatura de £404,00. O desconto médio aplicado sobre as transações foi de 26,43%. Esses indicadores gerais fornecem uma base quantitativa para compreender a escala das operações do varejo e o impacto das políticas de precificação e promoções. A visualização desses dados em um dashboard, como o desenvolvido, facilita a rápida compreensão desses valores agregados por parte dos gestores.

Dados de Clientes – Segmentação de Consumidores: Visão Geral

A segmentação dos consumidores foi realizada com base em sua frequência de compra e valor monetário, utilizando o algoritmo K-Means, uma técnica de agrupamento não supervisionada (Ikotun et al., 2023). Observou-se que a grande maioria dos clientes se enquadra no grupo de “consumidores comuns”, tanto em termos de valor total gasto quanto de frequência de compras. No entanto, a análise revelou que o grupo de “consumidores médios” apresenta um valor médio de compra por transação mais elevado, indicando um potencial de valorização desses clientes.

A distribuição da receita bruta demonstrou uma dependência significativa de um pequeno grupo de clientes de alto valor. Seis “consumidores grandes” foram responsáveis por 12,6% da receita bruta total, com um ticket médio 6,5 vezes superior ao dos consumidores comuns. Essa concentração de receita em poucos clientes de maior frequência e gasto aponta para uma oportunidade estratégica de crescimento, onde a atração de poucos novos clientes com esse perfil poderia gerar um aumento substancial na receita geral do negócio. A análise ressalta a importância de focar em estratégias de retenção e aquisição direcionadas a esses segmentos de alto valor.

Apesar da relevância da segmentação, a análise inicial dos dados de clientes evidenciou uma limitação na compreensão do cruzamento entre dados de consumidor e produto. Isso impede uma visão clara sobre quais produtos são preferidos pelos grandes consumidores ou se há padrões de compra que indicam revenda, o que poderia impactar a lucratividade da empresa. Adicionalmente, foi observado que os consumidores de alta frequência apresentaram um desconto médio de 30,52% menor do que o preço otimizado, calculado pela técnica IQR, sugerindo uma oportunidade para refinar as estratégias de precificação.

Detalhes de Clientes – Segmentação de Consumidores: Visão Geral

A análise da distribuição geográfica dos clientes revelou uma predominância do mercado britânico, o que é esperado para um varejo digital localizado na Inglaterra. Contudo, a granularidade dos dados por país trouxe observações surpreendentes. Países como Holanda e Irlanda, com apenas nove e três clientes, respectivamente, superaram em receita bruta mercados maiores como Alemanha e França. Este achado indica um potencial de crescimento significativo para o varejo, caso sejam desenvolvidas campanhas de marketing direcionadas a esses mercados.

Um fator que contribui para o desempenho da Holanda é o desconto médio aplicado, que foi de 33,53%, significativamente maior em comparação com os 26,65% da Inglaterra e 24,09% da Irlanda. Essa diferença nos descontos pode influenciar a atratividade e o volume de vendas em mercados específicos, sugerindo que a política de descontos é um elemento crucial a ser considerado nas estratégias de expansão geográfica. A capacidade de filtrar e analisar esses dados por país no dashboard permite uma compreensão aprofundada dessas dinâmicas.

Detalhes de Vendas – Detalhes de Vendas Temporais

A evolução mensal das vendas totais ao longo de 2011 apresentou uma tendência geral de crescimento, com períodos de baixa atividade em fevereiro e abril. O segundo semestre do ano demonstrou uma melhora significativa, culminando em um pico de vendas no mês de novembro. Essa sazonalidade é um achado importante para o planejamento de estoque e campanhas promocionais, permitindo que o varejo se prepare para os períodos de maior demanda e otimize suas operações.

Uma limitação importante na análise temporal foi o encerramento dos dados em 12 de dezembro, o que impediu a captura completa da atividade de vendas do mês. Essa truncagem dos dados pode distorcer a percepção da atividade de vendas de dezembro, um mês tipicamente de alta demanda devido às festividades de fim de ano. Séries temporais mais prolongadas seriam ideais para uma compreensão mais robusta dos comportamentos sazonais e para a aplicação de técnicas de previsão de vendas.

A taxa de devoluções e cancelamentos manteve-se relativamente estável ao longo do ano, com exceção de um aumento em dezembro e janeiro. Embora o alto volume de vendas no final do ano, impulsionado por produtos de presente, possa explicar parte dessas desistências, o fenômeno exige atenção dos gestores. É fundamental investigar se há fatores operacionais que contribuem para essas devoluções, como problemas de logística ou qualidade do produto, para mitigar impactos negativos na receita e satisfação do cliente.

Detalhes de Produto

A análise detalhada do desempenho dos produtos revelou os itens mais rentáveis do catálogo. O produto “REGENCY CAKESTAND 3 TIER” destacou-se, gerando uma receita de £174,4 mil libras esterlinas a partir da venda de aproximadamente 13,87 mil unidades. Em seguida, o “PAPER CRAFT LITTLE BIRDIE” contribuiu com mais de £168 mil em receita, demonstrando a importância desses produtos para o faturamento geral do varejo.

Contudo, a análise de produtos também expôs anomalias significativas nos dados, sublinhando a necessidade de um processo contínuo de limpeza e governança de dados. O item “PAPER CRAFT LITTLE BIRDIE”, apesar de ser o segundo mais rentável, apresentou uma taxa de retorno de 100% para uma quantidade encomendada consideravelmente alta. Embora possa ser uma devolução legítima, essa ocorrência distorce os dados e o modelo analítico, evidenciando que a limpeza de dados não é uma tarefa pontual, mas um processo recorrente.

Outra anomalia foi identificada no produto “PICNIC BASKET WICKER 60 PIECES”, que possuía um preço de tabela de aproximadamente £11, mas o preço médio praticado, segundo os dados, era de cerca de £650. Essa discrepância resultou em um desconto calculado de -5.919%, indicando um possível erro de registro de preço ou um problema no sistema. A identificação dessas inconsistências foi facilitada pela elaboração de um preço de referência via Intervalo Interquartil (IQR), uma técnica robusta para identificar outliers (Tuckey, 1977). A correção dessas anomalias requer colaboração com gestores para implementar processos de governança de dados, garantindo a fidelidade das análises.

Mesmo com as limitações de um banco de dados transacionais com ruídos, inconsistências e informações incompletas, o estudo demonstrou que a aplicação de técnicas de ciência de dados, como o data wrangling e a modelagem dimensional, permite transformar dados brutos em diagnósticos estratégicos. As visualizações dinâmicas em Power BI materializam o objetivo principal deste estudo, que é o processo completo de transformação de dados em um sistema de suporte à decisão. Este framework não apenas fornece informações valiosas, mas também estimula a maturidade digital da organização, promovendo maior disciplina na manutenção e estruturação dos dados e enriquecendo a cultura de tomada de decisão baseada em evidências.

Em síntese, os resultados obtidos demonstram que o framework desenvolvido, ao integrar data wrangling, modelagem dimensional e clustering, permite transformar dados transacionais brutos em inteligência de negócio acionável. A segmentação de clientes revelou perfis distintos e a importância de consumidores de alto valor, enquanto a análise geográfica e temporal identificou oportunidades de mercado e padrões sazonais de vendas. A detecção de anomalias nos dados de produtos ressaltou a necessidade crítica de governança de dados. Assim, o estudo atinge seu objetivo de fornecer uma fundação metódica para a tomada de decisão estratégica, mesmo com dados desafiadores.

4. Conclusão

O presente estudo buscou demonstrar uma fundação metódica para transformar dados transacionais brutos em inteligência de negócio acionável, facilitando a tomada de decisão sobre consumidores, produtos e vendas por meio da aplicação de técnicas de ciência de dados e visualização. Verificou-se a possibilidade de identificar distintos perfis de consumidores, com destaque para a relevância de clientes de alto valor e o potencial de crescimento em mercados internacionais específicos, como Holanda e Irlanda, que, com 9 e 3 clientes, respectivamente, superaram em receita mercados maiores com menor número de clientes. Observou-se, ainda, a sazonalidade das vendas, com picos em novembro e períodos de menor atividade em fevereiro e abril, e a ocorrência de anomalias nos dados de produtos, como taxas de retorno elevadas e discrepâncias de preços, que sublinharam a necessidade de governança de dados. A principal contribuição reside no desenvolvimento de um framework que integra data wrangling, modelagem dimensional e clustering, culminando na criação de dashboards interativos no Power BI, que convertem dados brutos em diagnósticos estratégicos, promovendo a maturidade digital e a tomada de decisão baseada em evidências.

Apesar dos achados significativos, o estudo enfrentou limitações inerentes à natureza dos dados transacionais brutos, que apresentavam ruídos, inconsistências e informações incompletas, como a dificuldade em cruzar dados de consumidor e produto para uma análise mais aprofundada de preferências ou padrões de revenda. A truncagem dos dados de vendas em dezembro também impediu uma compreensão completa da sazonalidade de fim de ano. Diante dessas observações, sugere-se para estudos futuros a ampliação da base temporal dos dados para uma análise sazonal mais robusta e a incorporação de informações adicionais sobre consumidores e localização para refinar as estratégias de marketing e vendas. Recomenda-se, ainda, a implementação de processos contínuos de governança de dados para mitigar anomalias e garantir a fidelidade das análises, fortalecendo a cultura de decisão orientada por dados na organização.

Referências Bibliográficas

Bálint, L.P.; Péntek, A.; Nabradi, Z.; Botos, S. 2025. How can data analytics and employee upskilling foster digital maturity and sutainable practices in SMEs?. Problems and Perspectives in Management, 23, 606-620. Disponível em <https://www.researchgate.net/publication/392425136_How_can_data_analytics_and_employ ee_upskilling_foster_digital_maturity_and_sustainable_practices_in_SMES> Acesso em 15 Mar. 2026

Chen, D., 2015. Online Retail [Dataset]. UCI Machine Learning Repository. Disponivel em <https://doi.org/10.24432/C5BW33>. Acesso em 15 Abr. 2025

Eberhard, K, 2023. The effects of visualization on judgment and decision-making: a systematic literature review. Magag Rev Q, 73, 167-241.

Handojo, A.; Pujawan, N.; Santosa, B.; & Singgih, M. L. 2023. A multi layer recency frequency monetary method for customer priority segmentation in online transaction. Cognet Engineering, 10(1). Disponível em <https://doi.org/10.1080/23311916.2022.2162679>. Acesso em 15 Mar. 2026

Ikotun, A.M.; Ezugwu, A. E.; Laith, A.; Abuhaija, B.; Heming, J. 2023. K-means Clustering Algorithms: A Comprehensive Review, Variants Analysis, and Advances in the Era of Big Data. Information Sciences, 622, 178-210. Disponível em <https://www.sciencedirect.com/science/article/abs/pii/S0020025522014633>. Acesso 25 Mar. 2026

Kahn, B, Jan, S, Khan, W, Chugthtai, M., 2024. An Overview of ETL Techniques, Tools, Processes and Evaluations in Data Warehousing. Journal on Big Data, 6, 1-20.

Kirmani, M. M., 2017. Dimensional modeling using star schema for data warehouse creation. Oriental Journal of Computer Science and Technology, 10(4), 745–754. Disponível em <http://www.computerscijournal.org/?p=7002>. Acesso em 15 Mar. 2026

Marr, B., 2017. Data strategy: How to profit from a world of big data, analytics and the internet of things. Kogan Page Publishers.

McAfee, A., Brynjolfsson, E., Davenport, T.H., Patil, D.J. and Barton, D., 2012. Big data: the management revolution. Harvard business review, 90(10), 60-68.

Tuckey, J.W., 1977. Exploratory Data Analysis. Addison-Wesley, Reading, MA.

Universidade Estadual do Rio Grande do Sul [UERGS], Gilmar de Azevedo. 2021. “Uma imagem vale por mil palavras”, mas diga isso sem as palavras. Disponivel em <https://www.uergs.edu.br/uma-imagem-vale-por-mil-palavras-mas-diga-isso-sem-as-palavras>. Acesso em 03 de Mar. 2025.

Wexler, S., Shaffer, J. and Cotgreave, A., 2017. The big book of “dashboards”: visualizing your data using real-world business scenarios. John Wiley & Sons.

Artigo oriundo de Trabalho de Conclusão de Curso da Especialização em Data Science e Analytics do MBA USP/Esalq

Para saber mais sobre o curso, clique aqui e acesse a plataforma MBX Academy

También te puede interesar

08 de octubre de 2026

Árvores de classificação e regressão para previsão dos resultados de deputados estaduais em São Paulo

As eleições no Brasil movimentam recursos significativos, e a formação de chapas competitivas é um desafio para os partidos. Avaliou-se a viabilidade de modelos de classificação e regressão baseados em árvores de decisão e florestas aleatórias para identificar candidatos com potencial de eleição e competitividade, e para prever sua votação nominal na disputa para deputado estadual em São Paulo em 2022. A amostra incluiu todos os candidatos a deputado estadual em São Paulo em 2022, utilizando dados eleitorais, demográficos, partidários e econômicos do período entre 2018 e 2022. A seleção de hiperparâmetros foi realizada por busca em grade, seguida de análise de sensibilidade para o ponto de corte, e a pontuação F1 foi a métrica principal. Comparou-se os modelos de árvore de decisão e floresta aleatória usando F1 e AUC-ROC. O modelo de classificação de candidatos competitivos alcançou uma pontuação F1 de 0,70 e 94% de AUC-ROC, demonstrando ser uma ferramenta viável para auxiliar a tomada de decisão de partidos e candidatos. Os modelos de previsão de eleitos e de votos nominais foram considerados insuficientes. Concluiu-se que características de eleições passadas e o conceito de competitividade são preditores relevantes para a previsibilidade eleitoral, e que o uso de árvores de classificação e regressão, especialmente florestas aleatórias, é adequado para a previsibilidade da competitividade de candidatos.

Palavras-chave: Análise de sensibilidade; Competitividade eleitoral; Florestas aleatórias; Scikit-Learn.

08 de octubre de 2026

Disrupções analíticas para a governança da pesca artesanal na Amazônia: Novas abordagens para dados limitados de desembarque

Técnicas de machine learning foram propostas para a governança da pesca artesanal na Amazônia, buscando superar limitações de dados de desembarque. O estudo objetivou constituir grupos de manejo, avaliar tendências temporais e propor modelos de predição para dados de desembarque pesqueiro, a fim de apoiar a tomada de decisão e o ordenamento. Os dados de desembarque, coletados entre 2010 e 2022 nos rios Baixo Amazonas e Baixo Araguaia-Tocantins, foram integralizados em uma matriz de análise. Adotou-se a família taxonômica como unidade de estoque funcional para agrupar os dados. Foram empregadas técnicas multivariadas de agrupamento (clusterização hierárquica e K-means), análise e simulação de séries temporais (modelo ARIMA Forecast otimizado) e técnicas multivariadas confirmatórias (modelos de regressão em painel longitudinal). A análise de agrupamento segmentou grupos de estoques funcionais por faixas de quilos de peixe (Alvos Mistos, Alvos Baixo Araguaia-Tocantins, Alvos Baixo Amazonas). A investigação de padrões temporais revelou que o atraso de 12 meses foi a melhor alternativa, indicando que as pescarias de um ano afetam as do ano seguinte. Os modelos ARIMA-Forecast otimizados foram bem ajustados, mas não detectaram tendência de declínio ou aumento no comportamento temporal, sugerindo estratégias de adaptação da pesca artesanal. O modelo em painel indicou um quadro estratégico de priorização de estoques funcionais para monitoramento e ordenamento. As abordagens analíticas disruptivas e inovadoras desenvolvidas modernizaram os protocolos de governança da pesca artesanal na Amazônia, fornecendo um painel de indicações estratégicas para o manejo, especialmente nas regiões do Baixo Amazonas e Baixo Araguaia-Tocantins.

Palavras-chave: Amazônia; Desembarque pesqueiro; Estoques funcionais; Governança; Manejo.

08 de octubre de 2026

Precificação dinâmica de estúdios por temporada com algoritmos “multi-armed bandits”

As plataformas digitais de hospedagem transformaram o mercado de aluguel por temporada na última década, tornando a precificação um determinante crucial do desempenho econômico dos imóveis. Investigou-se como algoritmos da classe “Multi-Armed Bandits” (MAB) podem otimizar essa decisão de preço, comparando-se as estratégias ε-Greedy, Upper Confidence Bound (UCB) e Thompson Sampling (TS). A base analítica reuniu 2.284 observações de 571 estúdios no Rio de Janeiro, coletadas entre junho de 2024 e março de 2025. A qualidade percebida dos imóveis foi sintetizada por Análise de Componentes Principais (PCA), e a demanda modelada por regressão linear ordinária (OLS) com sete variáveis significativas. O modelo explicou 10% da variação na ocupação. Simulações foram realizadas em 1.000 rodadas e 50 repetições estocásticas em cenários estacionário e dinâmico multi-estação. No cenário estacionário, o UCB maximizou a receita acumulada, seguido por ε-Greedy e TS. No cenário dinâmico multi-estação, o UCB manteve a receita absoluta mais alta, mas o TS apresentou queda relativa menor entre cenários, indicando maior adaptabilidade à volatilidade sazonal. Concluiu-se que, em mercados oscilantes, a adaptabilidade bayesiana do TS compensou seu custo de exploração, tornando-o mais robusto a mudanças de contexto.

Palavras-chave: Aprendizado por reforço; Decisão sequencial sob incerteza; Hospedagem de curta duração; Otimização de receita; Sazonalidade turística.

08 de octubre de 2026

Otimização do processo de gaseificação de biomassa para produção de hidrogênio usando redes neurais agregadas

A matriz mundial de produção de hidrogênio ainda é dependente em 98% de fontes fósseis, gerando um passivo ambiental de aproximadamente 9 kg de CO2 para cada kg de H2 produzido. No cenário brasileiro, a gaseificação do bagaço de cana-de-açúcar surge como uma alternativa de baixo carbono, porém a complexidade e a não-linearidade das reações termoquímicas dificultam o controle e a maximização do rendimento por métodos convencionais. O estudo objetivou identificar parâmetros operacionais ótimos para a gaseificação de biomassa, visando maximizar a fração molar de hidrogênio, por meio de uma abordagem computacional integrada que combinou simulação termodinâmica e técnicas de inteligência artificial. Para tal, o processo de gaseificação foi simulado no software Aspen Plus e, após validação com dados da literatura, gerou uma base de dados de 1.000 cenários por amostragem via hipercubo latino. Esses dados alimentaram um metamodelo de redes neurais agregadas por bootstrap (BANN) com 57 neurônios, seguido da aplicação do algoritmo de otimização por enxame de partículas (PSO) para a busca do ótimo global. O metamodelo alcançou um coeficiente de determinação R² de 0,9902 no conjunto de teste, indicando elevada capacidade preditiva. A otimização revelou que a fração molar de hidrogênio pode atingir 67,54% após enriquecido por meio da reação de deslocamento do gás de água (WGS) sob condições de 857,12 °C e razão de equivalência (ER) de 0,10. A integração BANN-PSO reduziu o custo computacional da otimização em aproximadamente 5.400 vezes em relação à simulação direta no Aspen Plus, identificando condições operacionais que maximizam a fração molar de hidrogênio para 67,54% na entrada da PSA. Ao integrar modelagem termodinâmica, aprendizado de máquina, otimização metaheurística e técnicas de interpretabilidade, o estudo contribuiu para o avanço metodológico na análise e intensificação de processos de produção de hidrogênio a partir de biomassa, oferecendo uma estrutura computacional reprodutível e aplicável a sistemas energéticos complexos no contexto da transição energética.

Palavras-chave: Aprendizado de máquina; Bagaço de cana; Gás de síntese; Meta-heurística; Sustentabilidade.

08 de octubre de 2026

Ferramentas de gestão do tempo em uma instituição bancária na cidade de São Paulo

A gestão do tempo constitui-se como um diferencial competitivo estratégico, especialmente no setor bancário, ambiente caracterizado por alta pressão e constante transformação tecnológica. O estudo teve como objetivo analisar as percepções dos colaboradores de uma instituição bancária na cidade de São Paulo acerca da eficácia e aplicabilidade das ferramentas de gestão do tempo em suas rotinas profissionais. Para isso, adotou-se uma metodologia de pesquisa descritiva, de abordagem quantitativa, operacionalizada por meio de um levantamento (survey) que envolveu 37 colaboradores, os quais responderam a um questionário estruturado de 14 questões. Os resultados revelaram que, embora 45,9% dos respondentes planejassem a maior parte de suas atividades, a técnica predominante utilizada foi a de listas de tarefas simples (64,9%), com baixa adesão a métodos mais estruturados. Os maiores obstáculos identificados para a gestão eficaz do tempo foram as interrupções não planejadas (43,2%) e o excesso de reuniões improdutivas. Um dado crítico apontou que a gestão ineficiente do tempo impactou diretamente a saúde mental e o estresse de 48,6% da amostra. Concluiu-se que a eficácia da gestão do tempo no ambiente bancário depende não apenas da adoção de ferramentas individuais, mas também de uma mudança na cultura organizacional que privilegie o trabalho focado e a redução da fragmentação das atividades. Recomendaram-se a implementação de práticas como o Time Blocking e a adoção de protocolos de reuniões mais objetivos para mitigar a sobrecarga e promover o bem-estar sustentável.

Palavras-chave: Bem-estar ocupacional; Cultura organizacional; Eficiência operacional; Metodologias ágeis; Produtividade.

Neurociencia Y Aprendizaje En La Educación

08 de octubre de 2026

Consequências do Uso de IA Generativa na Capacidade Cognitiva e Saúde Mental de Profissionais Brasileiros

A integração de ferramentas de inteligência artificial generativa (GenAI) no trabalho acelerou-se nos últimos anos, levantando questões sobre seus efeitos nos processos cognitivos e no bem-estar emocional dos profissionais. O estudo objetivou mensurar o impacto do uso de GenAI sobre capacidades cognitivas autorreferidas e indicadores de saúde mental de profissionais brasileiros, comparando os achados com evidências empíricas internacionais. Adotou-se uma abordagem mista, com delineamento transversal e não experimental, aplicando um questionário digital estruturado a 108 profissionais adultos brasileiros, recrutados via LinkedIn e WhatsApp. O instrumento avaliou memória de trabalho, atenção sustentada e alternada, controle inibitório, flexibilidade cognitiva, tecnoestresse, saúde mental e senso de propósito profissional, além de percepções qualitativas. Os resultados revelaram que 92,6% dos respondentes utilizaram GenAI regularmente, com impacto percebido majoritariamente positivo no desempenho, mas acompanhado por dependência declarada em 52,8% da amostra. A atenção sustentada mostrou-se a dimensão cognitiva mais fragilizada, e os indicadores de equilíbrio emocional e desconexão digital concentraram os resultados mais críticos. A análise comparativa identificou uma relação entre maior frequência de uso, maior dependência e menores escores cognitivos, com declínio progressivo da atenção focada ao longo do tempo de uso. Concluiu-se que o uso intensivo de GenAI coexiste com fragilidades cognitivas e emocionais mensuráveis, cujos efeitos tendem a se acumular, reforçando a necessidade de práticas conscientes que preservem a autonomia intelectual dos profissionais.

Palavras-chave: Cognição; Dependência tecnológica; Inteligência artificial; Saúde mental.

Neurociencia Y Aprendizaje En La Educación

08 de octubre de 2026

A contribuição da neuroaprendizagem na elaboração de objetos educacionais multimídia para a recomposição de aprendizagens

A defasagem de aprendizagem na educação brasileira, agravada pela pandemia de Covid-19 e evidenciada por resultados insatisfatórios do SAEB, tornou a recomposição de aprendizagens uma prioridade nacional. O presente trabalho analisou como a produção audiovisual, integrante de um programa de recomposição de aprendizagens em Língua Portuguesa e Matemática, desenvolvido para estudantes do 9º ano do Ensino Fundamental de uma rede estadual, incorporou fundamentos da neurociência da aprendizagem em sua estrutura metodológica. A pesquisa caracterizou-se como estudo de caso qualitativo e aplicado, e analisou 20 roteiros pedagógicos e as respectivas videoaulas produzidas e aplicadas em 2024. A partir do referencial teórico, construíram-se sete dimensões de análise: ludicidade e interatividade, funcionamento cerebral e aprendizagem, emoção e cognição, singularidade do estudante, contexto sociocultural, mediação pedagógica consistente e aprendizagem ativa. Os resultados indicaram que elementos da neuroaprendizagem foram incorporados de forma estrutural à metodologia do programa. Identificou-se que a personalização da aprendizagem não reside exclusivamente no objeto audiovisual, mas na cadeia sistêmica que o envolve, incluindo diagnóstico, produção, mediação presencial e monitoramento. A integração entre neurociência, conteúdos dedicados à superação de lacunas e linguagem audiovisual demonstrou ser uma estratégia metodologicamente consistente e com potencial relevante para ampliar a eficácia de programas de recomposição de aprendizagens.

Palavras-chave: Defasagem; Eduentretenimento; Mediação pedagógica; Plasticidade cerebral; Videoaula.

Gestión Escolar

08 de octubre de 2026

Lei do Novo Ensino Médio: monitoramento e avaliação da qualidade após a reforma

A qualidade do Ensino Médio no Brasil tem sido objeto de debates diante das mudanças iniciadas pela Lei nº 13.415/2017 e reestruturadas pela Lei nº 14.945/2024. Analisou-se a evolução de indicadores associados à qualidade do Ensino Médio entre 2017 e 2024, considerando aprendizagem, fluxo, permanência e equidade, e discutiram-se as implicações dos mecanismos federais de monitoramento para a gestão escolar. Realizou-se estudo exploratório e descritivo, de abordagem quantitativa e natureza documental, com dados secundários do Inep sistematizados pela plataforma QEdu e documentos oficiais do Ministério da Educação. Examinaram-se taxas de aprovação, reprovação e abandono, distorção idade-série, aprendizagem adequada no Saeb e desigualdades por rede de ensino, nível socioeconômico e unidade federativa. Os resultados mostraram melhora do fluxo e redução da distorção idade-série, mas permanência de baixos níveis de aprendizagem e desigualdades expressivas. A análise documental indicou maior estruturação da governança e do monitoramento da política, ainda sem avaliação consolidada de seus efeitos sobre a aprendizagem. Para a gestão escolar, os achados orientaram o acompanhamento da transição para a 1ª série, a identificação de riscos de abandono, a recomposição das aprendizagens e a priorização de grupos mais vulneráveis. Concluiu-se que a qualidade exige a leitura articulada de indicadores e decisões contextualizadas, sem atribuir exclusivamente ao Novo Ensino Médio relações causais que o desenho desta pesquisa não permite estabelecer.

Palavras-chave: Aprendizagem; Equidade educacional; Gestão escolar; Permanência escolar; Política educacional.

08 de octubre de 2026

Modelagem de emissão de CO2: Clusterização a partir de variáveis socioeconômicas e energéticas.

Um estudo aplicou técnicas de clusterização, com foco no algoritmo K-means, para agrupar os 20 membros do G20, incluindo a União Europeia, com base em sete variáveis socioeconômicas, energéticas e ambientais referentes ao ano de 2025. As variáveis consideradas foram Produto Interno Bruto (PIB), população, emissões de CO2 per capita, emissões de CO2 da construção civil, Índice de Desenvolvimento Humano (IDH), índice de Gini e participação de fontes renováveis na matriz energética. A relevância do setor da construção civil para as emissões globais e seu potencial de redução justificaram sua inclusão. O número ótimo de agrupamentos foi determinado pela combinação do método do cotovelo e do Índice de Silhouette, resultando em quatro clusters distintos. A Análise de Componentes Principais (PCA) foi empregada para visualizar os agrupamentos, e as duas primeiras componentes explicaram 69,86% da variabilidade dos dados. O Cluster 0, composto por China e Índia, caracterizou-se por elevada população e altas emissões da construção civil. O Cluster 1, com 12 países, apresentou alto desenvolvimento humano e elevadas emissões per capita. O Cluster 2, formado por Brasil, Indonésia, México e África do Sul, exibiu o menor PIB médio, maior desigualdade e baixas emissões per capita. O Cluster 3, que incluiu Estados Unidos e União Europeia, concentrou o maior PIB médio e as maiores emissões per capita. Os resultados evidenciaram a heterogeneidade entre os países do G20 e reforçaram a necessidade de políticas climáticas diferenciadas, adaptadas às características de cada grupo.

Palavras-chave: Cluster; CO2; Emissão; K-means; Países.