“Local-first” é usado para três promessas diferentes, e a maioria das comparações junta tudo numa só. Seus arquivos e resultados podem ficar locais. Suas chaves de API e tráfego de modelo podem ficar fora das mãos do fornecedor. Os pesos do modelo podem rodar no seu hardware. Uma ferramenta pode fazer as duas primeiras e não a terceira — a nossa faz exatamente isso. Aqui estão oito ferramentas com as três respondidas separadamente.
A ferramenta lê e escreve nas pastas do seu disco, e os entregáveis chegam lá? É o mais fácil dos três e quase tudo aqui passa.
Quando você usa sua própria chave, o tráfego vai direto da sua máquina ao provedor, ou passa antes pelo fornecedor da ferramenta? O Orkas não faz proxy: a chave é selada com AES-256-GCM numa configuração local e a chamada vai direto.
O modelo em si pode rodar em hardware seu — Ollama, llama.cpp, qualquer runtime local — de modo que nada saia da máquina? É a leitura mais estrita de local-first, e é a que o Orkas não satisfaz.
Telemetria, relatórios de falha e comportamento de conta não são avaliados aqui. Variam por build e versão, e uma tabela que fingisse o contrário envelheceria em silêncio. Confira a documentação atual de cada projeto antes de confiar em um número.
Esta lista é publicada pela Orkas, e o Orkas é uma das ferramentas nela. Toda linha que descreve o Orkas está marcada. As quatro regras abaixo foram definidas antes de a lista ser escrita, e todas as ferramentas são avaliadas pelas mesmas quatro.
As três promessas cumpridas
Perguntas e respostas sobre documentos locais, capaz de rodar totalmente offline com um modelo local. Se o requisito é que um conjunto de documentos nunca toque a rede, este é o caminho mais curto da lista.
Ele responde perguntas sobre documentos. Transformar essas respostas em um entregável pronto é outro trabalho.
Ler a comparação completa de AnythingLLM →Um agente local open source com CLI e app desktop, dezenas de extensões MCP e ampla lista de provedores. Aponte para o Ollama e os pesos ficam no seu hardware. Também dá para montar uma distribuição com seus provedores e sua marca.
Um agente de uso geral do começo ao fim, sem especialistas de mídia ou documentos de escritório.
Ler a comparação completa de Goose →Uma interface de chat self-hosted em que toda a equipe faz login, com ampla cobertura de modelos, incluindo runtimes locais. A única entrada feita para várias pessoas ao mesmo tempo.
É uma superfície de chat. Não devolve arquivos prontos.
Ler a comparação completa de LibreChat →Um agente de código de terminal com licença MIT, dezenas de provedores, qualquer coisa compatível com OpenAI e runtimes locais. TUI primeiro, com o app desktop mais recente. Separa um agente de plano somente leitura de um agente de build com acesso total, a uma tecla de distância.
Ele mira o repositório. A metade de um lançamento que não é código está fora do que um agente de código faz.
Ler a comparação completa de OpenCode →Um gateway self-hosted com clientes de canal, provedores configurados ou modelos locais, e uma biblioteca de skills madura, forte em operar a própria máquina. Execuções de subagentes em segundo plano e aninhadas são nativas.
Você opera o gateway, então há infraestrutura para manter no ar.
Ler a comparação completa de OpenClaw →Um agente autônomo sempre ativo que você roda no seu servidor, VPS ou infraestrutura serverless, para cron e trabalho headless de longa duração. Open source; traga seu modelo, incluindo o Nous Hermes.
Sem handle de retomada e sem protocolo de diretório de projeto, então um host precisa reenviar o histórico para continuar uma conversa. Só é um limite se você quiser um host no circuito.
Ler a comparação completa de Hermes Agent →Arquivos e chaves locais, modelo pela rede
Uma equipe de agentes desktop em macOS e Windows. Seus arquivos, chaves e resultados ficam na sua máquina; com sua própria chave, o tráfego de API nunca passa pelo Orkas — a chave é selada com AES-256-GCM autenticado numa configuração local, excluída de sincronização em nuvem e decifrada só em memória para chamar seu provedor diretamente. Licença MIT e auditável.
A terceira promessa é a que ele não faz: não há runtime de modelo local. As chamadas vão a um provedor pela rede — os modelos oficiais gerenciados, ou sua chave. Se os pesos precisam ficar no seu hardware, escolha um dos seis acima.
Veja como esse limite funciona →Automação de fluxos self-hosted que move dados entre sistemas por gatilho, em infraestrutura sua. Está aqui porque “local-first” muitas vezes é, na verdade, uma pergunta sobre onde o pipeline roda, não onde o modelo roda.
Ele move os dados. Não produz o entregável que uma pessoa revisa.
Ler a comparação completa de n8n →| Ferramenta | Arquivos e resultados | Chaves e tráfego de modelo | Pesos do modelo no seu hardware |
|---|---|---|---|
| Orkas Nosso | Na sua máquina | Direto ao seu provedor, sem proxy | Não — sem runtime de modelo local |
| Goose | Na sua máquina | Seu provedor configurado | Sim — via Ollama |
| AnythingLLM | Na sua máquina | Seu provedor configurado, ou nenhum | Sim — pode rodar totalmente offline |
| LibreChat | No host que você opera | Seu provedor configurado | Sim — runtimes locais suportados |
| OpenCode | Na sua máquina | Dezenas de provedores, qualquer coisa compatível com OpenAI | Sim — runtimes locais suportados |
| OpenClaw | No gateway que você hospeda | Provedores configurados | Sim — modelos locais suportados |
| Hermes Agent | No seu servidor ou VPS | Seu provedor configurado | Sim — traga seu modelo |
| n8n | No host que você opera | O que cada nó tiver configurado | Depende do nó |
Leia a última coluna como um requisito, não como nota. A maioria de quem procura um agente local-first quer as duas primeiras colunas — documentos e chaves sob seu controle — e aceita chamar um modelo hospedado. Se você é da minoria que realmente precisa dos pesos no próprio disco, só essa coluna importa, e ela tira o Orkas da jogada.
O Orkas é grátis, licenciado sob MIT e open source, então nada desse limite é uma afirmação que você precise aceitar por fé — o tratamento de chaves está no repositório que você pode ler.
Verificado em 11 de setembro de 2026, três execuções independentes no mesmo dia. A licença e a atividade dos oito repositórios vieram da API do GitHub; a coluna do Orkas veio do código em produção no commit 54cab3031 — que também é a origem do limite “sem runtime de modelo local” na linha sete, e não de uma decisão de marketing para soar modesto.
A terceira coluna — se os pesos podem rodar no seu próprio hardware — é citada da documentação de cada projeto para os sete que não são nossos. É referenciada, não medida, e é a coluna que mais vale reconferir antes de fechar com uma ferramenta. Telemetria e comportamento de conta estão totalmente fora do escopo. Vale nomear: o n8n usa uma licença sustainable-use, não uma licença open source padrão.
É local-first para seus arquivos, suas chaves e seus resultados, e não é local para os pesos do modelo. As duas metades dessa frase estão nesta página porque juntá-las é justamente como essas listas costumam enganar. Se seu requisito é a segunda metade, esta página nomeia seis ferramentas que a atendem.
Não. Com suas próprias chaves, a chave é cifrada com AES-256-GCM autenticado antes de tocar o disco, gravada numa configuração local excluída da sincronização em nuvem e decifrada só em memória para chamar seu provedor diretamente da sua máquina. Os modelos oficiais gerenciados são o caminho separado, e são opcionais.
AnythingLLM se o trabalho é perguntar sobre documentos, Goose se você quer um agente geral com Ollama atrás, OpenCode se o trabalho é código. Os três mantêm os pesos no seu hardware. O Orkas não é a resposta para esse requisito e esta página não finge o contrário.
O Orkas é grátis e licenciado sob MIT para macOS e Windows. Traga sua chave de provedor e o tráfego de modelo nunca passa por nós.