Skip to content
View dantas6773's full-sized avatar

Highlights

  • Pro

Block or report dantas6773

Block user

Prevent this user from interacting with your repositories and sending you notifications. Learn more about blocking users.

You must be logged in to block users.

Maximum 250 characters. Please don’t include any personal information such as legal names or email addresses. Markdown is supported. This note will only be visible to you.
Report abuse

Contact GitHub support about this user’s behavior. Learn more about reporting abuse.

Report abuse
dantas6773/README.md

João Pedro Dantas Thal

Estudo Ciência de Dados & IA no Ibmec BH. Construo agentes de IA, pipelines de dados e aplicações web — e passo tanto tempo verificando o que construí quanto construindo.

O padrão que atravessa tudo aqui é o mesmo: não confiar que algo funcionou só porque está documentado. Todo projeto declara o que ele não sustenta, todo corte de decisão vem com teste de sensibilidade, e os resultados que deram errado ficam publicados junto com os que deram certo.


Agentes de IA

escriba — transforma material bruto de aula (vídeo, áudio, PDF, slide, foto do quadro) na anotação final já no padrão do vault, na pasta certa e commitada. O roteamento é uma cascata de três camadas que sempre reporta qual camada decidiu, e o /mover corrige o arquivo, os links e a regra que errou. O APRENDIZADOS.md lista 6 defeitos que três rodadas de revisão não pegaram e só apareceram no uso real.

Engenharia de software

cptm-sos — redesenho do app da CPTM com um fluxo de emergência para quem se sente inseguro no trem. Demonstração no ar ↗ · Projeto Integrador do Ibmec, em grupo de seis; atuei como Scrum Master. 213 testes automatizados (93 de API, 120 de ponta a ponta) verificados por mutação — quebrar de propósito o que acabou de ser consertado, para conferir que a suíte reprova. Foi assim que apareceram testes que mediam o elemento errado. Acessibilidade validada com axe-core em WCAG 2.1 AA, com a única exceção documentada pelo nome.

Análise de dados

analise-chamados-service-desk — 199.423 chamados de TI. 95,2% dos não-telefônicos fecham entre os minutos :40 e :44 de alguma hora, contra 7,8% no grupo de controle. O fechamento não registra a resolução: registra uma rotina automática varrendo o que estava velho — o que invalida SLA e tempo de resolução como métricas. A anonimização tem uma função que se recusa a gravar se sobrar um CPF.

analise-fiis-liquidez — 547 fundos imobiliários em dois retratos com cinco meses de distância. Os dois rankings não têm um único fundo em comum. O scraper espera a contagem de linhas parar de crescer em vez de usar tempo fixo, porque a tabela renderiza em duas fases e um timeout gravaria 20 fundos de 547 sem erro e sem aviso.

brasil-em-foco — commodities, varejo e financeiro em três choques brasileiros (2014–2024). Do Hackathon Ibmec_Tech 2026 (Databricks + FactSet), reconstruído fora do Databricks para ficar reproduzível. Três tentativas de melhorar os modelos estão documentadas incluindo as que não foram adotadas, com o motivo.

extracao-citacoes-academicas — 1.995 citações em 19 artigos, do PDF ao grafo. Volume de citação não é influência: o 2º autor mais citado do corpus aparece em um único artigo.

analise-diagnostica-olimpiadas-2024 — Paris 2024 cruzado com indicadores do World Bank. Dois códigos de país do COI colidem silenciosamente com os de outros países no padrão ISO-3166.


Stack

Python pandas scikit-learn Jupyter TypeScript Node.js Playwright SQL Git Claude Code

Atualmente

  • A partir de setembro de 2026, integro um grupo de pesquisa do CEAp/Ibmec sobre Machine Learning Explicável (SHAP) aplicado à detecção de intrusão em redes. Detecção de intrusão e detecção de fraude são o mesmo problema estrutural — é para lá que quero levar minha carreira.
  • Estudo para a certificação CompTIA Network+ (N10-009), usando um tutor de IA que adaptei de um template aberto e uso desde julho de 2026.
In English

I study Data Science & AI at Ibmec BH, in Brazil. I build AI agents, data pipelines and web applications — and I spend as much time verifying what I built as building it.

One idea runs through everything here: never trust that something worked just because it is documented. Every project states what it does not support, every decision threshold ships with a sensitivity test, and the results that failed are published next to the ones that worked.

  • escriba — an agent that turns raw class material into a finished, structured note. Its routing always reports which rule made each decision.
  • cptm-sos — emergency flow for passenger safety on São Paulo's commuter rail. Live demo ↗ · 213 automated tests, verified by mutation testing; accessibility checked against WCAG 2.1 AA.
  • analise-chamados-service-desk — 199,423 IT tickets. 95.2% of non-phone tickets close within the same five-minute window each hour: the closing timestamp records an automated sweep, not a resolution. This invalidates SLA as a metric for that operation.
  • analise-fiis-liquidez — 547 real estate funds, two snapshots five months apart. The top-ten lists share zero funds once a liquidity filter is applied.

From September 2026 I join a research group on Explainable ML (SHAP) for network intrusion detection. Intrusion detection and fraud detection are the same structural problem, and that is where I want to take my career.


🌐 dantas6773.github.io — os 199.423 chamados deste acervo, em 3D

📍 Belo Horizonte, Brasil · LinkedIn

Pinned Loading

  1. analise-chamados-service-desk analise-chamados-service-desk Public

    Análise de 199 mil chamados de TI: o fechamento é decidido por uma rotina automática, não por quem resolveu — e isso invalida SLA e tempo de resolução como métricas

    Python

  2. analise-fiis-liquidez analise-fiis-liquidez Public

    Análise de 547 fundos imobiliários: por que ordenar por dividend yield sem filtrar liquidez produz um ranking inútil

    Jupyter Notebook

  3. brasil-em-foco brasil-em-foco Public

    Commodities vs. varejo vs. financeiro em 3 crises brasileiras (2014-2024): pipeline de dados, Prophet, K-Means e regressão. Do Hackathon Databricks + FactSet.

    Jupyter Notebook

  4. cptm-sos cptm-sos Public

    Redesenho do app da CPTM com um fluxo de emergência para quem se sente inseguro no trem. Projeto acadêmico em grupo — Node, TypeScript, 213 testes automatizados.

    TypeScript

  5. escriba escriba Public

    Agente que transforma gravação, PDF e slides de aula em nota pronta no Obsidian — roteada, formatada e commitada. Claude Code, whisper.cpp local

    Shell

  6. extracao-citacoes-academicas extracao-citacoes-academicas Public

    Extração e análise de 1.995 citações em 19 artigos científicos, do PDF ao grafo de citações

    Jupyter Notebook