GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

Estudo do MIT revela que verificadores de fatos por IA prejudicam a capacidade dos usuários de identificar notícias falsas

Em um experimento de quatro semanas com 67 participantes, pesquisadores do MIT permitiram que uma IA precisa emitisse vereditos binários sobre notícias. Embora a IA estivesse correta na maior parte do tempo, os usuários que confiaram nela apresentaram uma queda mensurável em sua própria capacidade de identificar desinformação na ausência da ferramenta.

AI · 2 min de leitura

Imagens superam o texto no Gemini: Matemática, scripts não latinos e tabelas custam menos

O Gemini do Google conta tokens de imagem por blocos de 768 pixels, cobrando 258 tokens por cada um. Ao manter as imagens dentro de um único bloco — ou usá-las para dados densos como equações, tabelas ou scripts não latinos — os desenvolvedores podem, muitas vezes, pagar muito menos do que se enviassem a mesma informação em formato de texto.

AI · 3 min de leitura

75% das interações do Claude Code são de leitura

75% das interações do Claude Code são de leitura. A maioria das pessoas pensa que agentes de codificação de IA passam seu tempo escrevendo código. Novos dados mostram que isso está errado. A Red Hat analisou 219 sessões reais do Claude Code. T…

AI · 3 min de leitura

O Cache de Prompts do Claude Falha Silenciosamente

O Cache de Prompts do Claude Falha Silenciosamente. O cache de prompts do seu Claude pode estar falhando sem que você perceba. Adicionei controle de cache a um manipulador de WhatsApp. Eu acompanhei os logs por um...

AI · 3 min de leitura

GraphRAG + Memória Persistente Impede que Chatbots Esqueçam ao Fechar a Aba

Ao converter o texto recuperado em um grafo de entidades e relacionamentos, o GraphRAG permite que os modelos raciocinem sobre múltiplos documentos, enquanto uma memória contextual de três níveis armazena diálogos de curto prazo, fatos de longo prazo do usuário e dados podados seletivamente para persistir após atualizações de página e novas abas.

AI · 3 min de leitura

DiffusionGemma gera 1.500 tokens/s em uma única H100, superando os 303 da Gemma 4

O DiffusionGemma substitui o tradicional loop de tokens da esquerda para a direita por um bloco de difusão de 256 tokens, removendo o ruído de todo o bloco em paralelo. A abordagem reduz a latência para agentes de IA em tempo real, embora apresente uma queda de 88,3 para 69,1 no benchmark AIME e tenha dificuldades com prompts curtos.

AI · 3 min de leitura

Escalonamento do Claude reduz gastos de API em 35% e diminui a latência para 27 s

O autor desenvolveu um mapeamento estático que atribui tarefas com base na ambiguidade aos modelos Haiku, Sonnet ou Opus, e adicionou uma regra de escalonamento após duas falhas. Ao longo de quatro semanas, o sistema manteve a qualidade, reduzindo os gastos de API para 65% do original e diminuindo o tempo médio de resposta de 42 s para 27 s.

AI · 3 min de leitura

Primeiro conjunto de satélites de demonstração previsto para o final de 2027 para entregar downlink de até 1 Tbps

A constelação de órbita terrestre baixa da EON, composta por 20 satélites, utilizará lasers de alta potência e estações terrestres com diversidade climática para fornecer links em escala de terabits em rotas de alto valor, como França-Austrália, visando oferecer capacidade dedicada e de baixa latência para clientes com alta demanda de IA.

AI · 4 min de leitura