Pesquisa e dados abertos
Análises rigorosas com dados públicos, metodologia transparente e código aberto. Contribuições ao conhecimento que qualquer pessoa pode verificar.
Harness de agentes: cinco camadas e como construir o seu
As cinco camadas de um harness de agentes, o mapa dos harnesses abertos e fechados de 2026, e por que Harvey, Legora, Rogo e Hebbia venceram construindo o harness do seu setor, e não um modelo melhor.
GPT-6 Astra: o que a OpenAI realmente anunciou e o que isso significa
Síntese técnica do lançamento do GPT-6 Astra: benchmarks contra Fable 5.1, os 99,9% no ARC-AGI-3 e seu asterisco, a economia de tokens e a queda da monitorabilidade do raciocínio.
Dashboard interativo: 15 presidentes do México sob o mesmo algoritmo
Análise quantitativa interativa das 15 administrações presidenciais do México (1934-2024). 9 variáveis estruturais, Z-score regional LatAm-5, Índice de Dificuldade Contextual e bootstrap com 1.000 simulações.
Como reduzir fraude em 73% com Machine Learning: estudo de caso
Caso prático de implementação de um sistema de detecção de fraude financeira com ML para uma fintech na América Latina. Arquitetura, features, modelo e resultados em produção.
De monolito a microsserviços: guia prático para empresas em crescimento
Guia técnico para migrar de uma arquitetura monolítica para microsserviços. Padrões, antipadrões, decisões de domínio e lições aprendidas em produção.
Estado da IA empresarial na América Latina 2026
67% das grandes empresas latino-americanas já têm IA em produção; apenas 23% relatam impacto mensurável. O que as separa, por setor: tendências, barreiras, talento e orçamento 2026.
EU AI Act: guia de conformidade para exportadores LATAM→UE
Já em vigor para práticas proibidas e regras de GPAI; as obrigações de alto risco entram por fases entre 2027 e 2028. Multas de até €35M ou 7% da receita global. Checklist de 20 pontos, stack self-hosted para residência de dados e calendário de remediação para SaaS e fintechs latino-americanas que processam dados europeus.
Stack de IA self-hosted em um droplet Digital Ocean de $40: Qdrant + Langfuse + LiteLLM + Redis
Docker Compose de produção com Qdrant, Langfuse, LiteLLM Proxy, Redis 8 e Ollama em um droplet de $40. Nginx + Certbot, backups para Spaces, monitoramento com Grafana e Prometheus.
Construir um recepcionista IA em espanhol: Pipecat + Deepgram + Cartesia + Qdrant
Agente de voz em espanhol mexicano para clínicas odontológicas e escritórios jurídicos. Stack OSS: Pipecat, Deepgram, Cartesia, Qdrant, Langfuse e Redis.
MCP templates: o padrão que faltava para chatbots empresariais
Dez servidores MCP prontos para produção: CRM, WhatsApp Business, faturamento CFDI, calendário, Postgres com RLS e RAG com Qdrant.
GEO vs SEO em 2026: por que 50% dos seus cliques orgânicos desaparecem e como medir
Generative Engine Optimization explicado com benchmark próprio: 20 marcas mexicanas medidas em ChatGPT, Perplexity, Gemini e Claude.
Auditar se o ChatGPT cita sua marca: ferramenta open source em Go com LiteLLM e Qdrant
Script em Go que testa 100 queries contra 5 LLMs via LiteLLM proxy, vetoriza respostas em Qdrant e detecta citações semânticas.
MCP do zero: servidor em Go com Postgres, Gmail e Calendar em 30 minutos
Guia prático para implementar um servidor MCP em Go usando mcp-go, com integração a Postgres, Gmail API e Google Calendar.
Langfuse + Redis + Mem0 como memória de agentes em produção: padrão tiered memory
Padrão de memória em camadas para agentes LLM: Redis, Langfuse e Mem0. Código Go e heurísticas de expiração.
Pesquisa Numoru: estado dos agentes de IA em empresas LATAM 2026
Resultados de pesquisa própria com 87 empresas latino-americanas sobre frameworks, bancos de vetores, observabilidade e barreiras reais.
Context engineering: por que seu RAG quebra aos 50k tokens e como consertar
De RAG ingênuo a RAG de produção: Chonkie, Qdrant híbrido, BGE-reranker, Contextual Retrieval, RAPTOR, RedisVL e Ragas.
Orquestrar três agentes para uma clínica odontológica com LangGraph, Qdrant, Mem0 e Temporal
Caso completo: três agentes orquestrados com LangGraph e Postgres checkpointer, memória Mem0, fluxos Temporal, guardrails e Langfuse.
Evals de agentes em CI/CD: Promptfoo + DeepEval + Langfuse + GitHub Actions
Pipeline que roda a suíte completa de evals em cada PR: dataset dourado, detecção de regressões, métricas RAG e bloqueio de merge.
Matriz de adoção de IA por vertical no México: onde pagam mais e onde pagam menos
Cruzamento de dados Fed, Deloitte e observação local: qual vertical paga mais por IA, qual está subdigitalizado e que stack se aplica.
Vibe coding seguro: pipeline de QA para código gerado com Cursor, Aider e Cline
Como auditar código IA antes da produção: Semgrep, Bearer, Trivy, SonarQube, DSPy e Promptfoo.
Fine-tuning do Llama 3.3 para CID em espanhol: dataset, custos e benchmarks contra Claude
Fine-tuning do Llama 3.3 8B no catálogo CID-11 em espanhol: Unsloth, vLLM, Qdrant e lm-eval-harness.
n8n blueprint para imobiliária: WhatsApp + CRM + listings IA com Qdrant e Ollama
Fluxo n8n self-hosted exportável: busca semântica com Qdrant, geração de descrições com Ollama, WhatsApp Business e Langfuse.
Como escolher consultoria de IA no México (2026)
Guia 2026 para escolher consultoria de IA no México: 8 critérios, red flags, benchmarks de preço e modelo de RFP. Pela Numoru.
Mais pesquisas em breve...