Como construí um RAG com três bases que roteia sem chamar um LLM sequer.
Eu mudei de uma LLM que escolhe onde pegar a informação para aritmética simples e exata. Veja como fiz isso.
Ler o postSou Diego Mirhan, estudante de Ciência da Computação. Aqui escrevo sobre o que construo e testo com LLMs locais, RAG, visão computacional e engenharia de dados.
Receba os novos posts por e-mail
Eu mudei de uma LLM que escolhe onde pegar a informação para aritmética simples e exata. Veja como fiz isso.
Ler o postA distância entre modelos de pesos abertos e fechados caiu de 13 para 6 pontos em um ano, e setembro trouxe cortes de preço dos dois maiores laboratórios. Minha aposta e o que me faria mudar de ideia.
A AMD comprou um laboratório de modelos de mundo, e a NVIDIA levou a Hugging Face semanas antes. As duas fabricantes de chips estão subindo na pilha de IA.
Os Dots trabalham sozinhos, com credenciais e ferramentas próprias. O lançamento veio um dia depois de a OpenAI se desculpar por uma invasão feita por seus agentes.
Nesse artigo discutirei a definição de sistemas quânticos e como a entropia limita sua alta escalabilidade devido a necessidade de…
Nesse artigo irei abordar todos os aspectos que envolvem a execução de instruções usando a técnica de pipeline, amplamente usada por…
Uma análise de como a organização em múltiplos níveis de cache e o aproveitamento da localidade de memória influenciam o desempenho…
Aprender a programar vai além dos números; é essencial entender o funcionamento do hardware e as escolhas que você faz como programador.