Mudei tudo para IA local e parei de enviar meus documentos para a nuvem.

Durante muito tempo, não hesitei em colar um contrato no ChatGPT, enviar um relatório confidencial para solicitar um resumo ou inserir uma proposta de cliente em uma ferramenta de IA na nuvem. Até que um dia parei para ler os Termos de Serviço (algo que eu vinha folheando preguiçosamente há anos) e percebi: esses arquivos estavam saindo do meu dispositivo e ficando, pelo menos temporariamente, nos servidores de outra pessoa. Curiosamente, descobri que um ex-colega já havia explicado o motivo. Não confie informações confidenciais ao ChatGPT.Esse incômodo me levou a procurar uma maneira melhor.

Mudei tudo para IA local e parei de enviar meus documentos para a nuvem.

O que eu descobri foi o AnythingLLM, um aplicativo de desktop gratuito e de código aberto que permite criar um assistente de IA totalmente personalizado a partir dos seus próprios documentos — e faz tudo isso no seu dispositivo. Ele se tornou um dos... Aplicações de IA de código aberto que eu uso todos os dias.Eis como a transformação realmente aconteceu.

A instalação e configuração do AnythingLLM leva apenas alguns minutos.

Ele informa exatamente para onde seus dados vão antes mesmo de você começar.

Após obter o arquivo de instalação, clique duas vezes nele e o assistente iniciará o processo. Durante a instalação, ele baixa automaticamente os componentes necessários: as bibliotecas CUDA do Ollama, caso você tenha uma GPU NVIDIA compatível — um processo que você apreciará assim que o entender. O que são núcleos CUDA e como eles melhoram o poder computacional geral? FFProbe para processamento de mídia e recursos do Meeting Assistant para áudio. Nada disso requer qualquer intervenção sua. Todo o processo, desde clicar duas vezes no instalador até visualizar o painel de controle principal, levou menos de cinco minutos.

Ao abrir o AnythingLLM, uma das primeiras coisas que aparece é uma tela sobre tratamento de dados e privacidade — e vale a pena lê-la. Ela afirma claramente que seu formulário e conversas só podem ser acessados ​​no seu dispositivo, que o texto do documento é incorporado de forma privada nesta instância usando o AnythingLLM Embedder integrado e que seus vetores são armazenados localmente via LanceDB. Se você já pesquisou por O que é um banco de dados vetorial e como ele aprimora a inteligência artificial?Você perceberá que manter esse componente completamente offline é uma grande vantagem em termos de privacidade. Não há botões de ativação/desativação, e as opções de desativação estão escondidas nas configurações. Por padrão, tudo permanece local.

Logo após a visão geral de privacidade, o AnythingLLM guia você pela tela de preferências do LLM. A lista de provedores suportados é extensa: na nuvem, estão OpenAI, Anthropic, Azure OpenAI, Gemini, Groq e outros. Para soluções totalmente locais, há Ollama, LM Studio, LocalAI, KoboldCPP, Dell Pro AI Studio, Microsoft Foundry Local e Docker Model Runner, entre outros. A opção padrão "AnythingLLM" combina um executor de modelos local baseado no Ollama, o que significa que você pode baixar modelos como o Phi-4 da Microsoft (9.1 GB) ou o Qwen3 0.6B da Alibaba (apenas 600 MB) diretamente do aplicativo, sem qualquer configuração adicional.

Se o seu computador não tiver uma unidade de processamento gráfico (GPU) dedicada, não há problema. Conectar-se à API do Groq dá acesso a modelos de inferência rápidos, como o Llama 3 70B, a um custo quase zero, e você só precisa de uma chave de API para começar a usar. Você pode trocar de provedor a qualquer momento nas configurações, então não fica preso à opção selecionada na configuração inicial. Comecei com o provedor local para testes — o Phi-3 3.8B me surpreendeu com o desempenho no processamento de perguntas e respostas de documentos em um laptop de gama média — e depois mudei para o Groq para tarefas mais pesadas, onde a velocidade era mais importante.

Uma vez configurado, o AnythingLLM transforma seus documentos pessoais em um assistente de IA focado.

Seus arquivos voltam a se expressar de forma mais clara.

O painel de controle apresenta uma lista de verificação para começar e uma barra lateral que já contém um espaço de trabalho virtual chamado "Meu Espaço de Trabalho". Os espaços de trabalho são o conceito organizacional central da AnythingLLM: cada um é um ambiente independente onde seus documentos e conversas coexistem. Pense em cada espaço de trabalho como uma sala separada: uma para contratos com clientes, outra para pesquisas internas e uma terceira para anotações pessoais. Os documentos podem ser compartilhados entre os espaços de trabalho, se necessário, mas não interferem uns nos outros, mantendo o foco e a precisão das respostas da IA.

Adicionar documentos à área de trabalho é simples, bastando arrastar e soltar. O AnythingLLM lida com documentos do Word, arquivos de texto simples, arquivos CSV, planilhas, arquivos de áudio e até mesmo PDFs, de forma semelhante a como... O NotebookLM usa essa tecnologia para transformar qualquer arquivo PDF em uma conversa interativa.Há também um campo "Buscar site" no painel de upload. Assim, se você quiser buscar uma página da web ou um recurso online, basta colar a URL e o conteúdo será extraído automaticamente. Após o upload, o AnythingLLM processa cada arquivo, dividindo o texto e armazenando os vetores localmente. Um arquivo PDF típico de dez páginas leva apenas alguns segundos para ser processado.

Agentes e ordens policiais tendenciosas levam o AnythingLLM para além de uma simples busca inteligente.

É aqui que a coisa fica realmente emocionante.

A interface de chat do AnythingLLM exibe um prompt @agent ativo.

O AnythingLLM vem equipado com funcionalidades de agente que vão além de simples perguntas e respostas sobre documentos. Ele realiza digitação. @agente No chat, você pode ativar um agente de IA capaz de executar tarefas de chamada de ferramentas: buscas na web, buscas mais aprofundadas e ações entre aplicativos. Habilidades personalizadas para o agente estão disponíveis no AnythingLLM Community Hub, cuja biblioteca está em constante expansão. O recurso de comando de barra permite criar e salvar modelos de prompts para tarefas repetitivas — como resumir anotações de reuniões em um formato consistente, redigir respostas de e-mail em um tom específico ou extrair campos específicos de documentos carregados a cada vez.

Se você quiser ir além, existe uma extensão para navegador que permite interagir com sua instância do AnythingLLM a partir de qualquer página da web, e uma integração com GPTLocalhost que traz o assistente diretamente para o Microsoft Word. Equipes que precisam de acesso compartilhado podem optar pela versão Docker, que adiciona suporte a múltiplos usuários, controles baseados em funções e listas de permissão. O aplicativo para desktop é mais do que suficiente para uso pessoal, mas é bom saber que existe uma opção de configuração para equipes.

Bem-vindos à revolução da IA ​​para vocês (população: vocês)

Ao migrar para o AnythingLLM, deixei de ver a IA como um serviço que alugo e passei a vê-la como uma ferramenta que possuo. Meus documentos permanecem no meu computador, minhas consultas permanecem privadas e agora tenho um assistente digital que realmente entende meu contexto, não apenas a internet pública.

Ir para o botão superior