Orkas Orkas
Início Blog Produto
Produto

O que é a IA que dá prioridade ao funcionamento local? Os seus dados, as suas chaves, a sua máquina

O que significa IA com prioridade ao funcionamento local: os dados do espaço de trabalho ficam no dispositivo por predefinição, enquanto os modelos podem ser geridos ou usar diretamente o seu próprio fornecedor.

A maioria das aplicações de IA que usa hoje são clientes leves para a nuvem de outra pessoa. Escreve um prompt, que é enviado para os servidores dessa entidade; os seus ficheiros são carregados para que o modelo os possa ler; o seu histórico de conversas fica na base de dados dessa entidade; e a chave da API – se existir – pertence-lhe, sendo-lhe cobrada a si com uma margem. Esta configuração é conveniente e, para muitas utilizações, adequada. Mas assume silenciosamente uma coisa: que os seus dados, o seu trabalho e as suas credenciais são de propriedade deles.

A IA com prioridade ao funcionamento local inverte esta lógica predefinida. Este artigo explica o que significa realmente "prioridade ao funcionamento local", o que muda quando aplica este princípio especificamente à IA e como saber se uma ferramenta que afirma dar prioridade ao funcionamento local o faz realmente. O Orkas foi construído desta forma, pelo que vamos usá-lo como exemplo concreto, mas as ideias aplicam-se a qualquer ferramenta desta categoria.

Nota de âmbito. As secções sobre chave própria descrevem a opção BYO do Orkas. Os modelos oficiais geridos usam o serviço gerido do Orkas. A prioridade ao funcionamento local descreve as predefinições do espaço de trabalho e o controlo, não exige que todas as chamadas evitem passar pelo Orkas.

Em resumo A prioridade ao funcionamento local diz respeito à localização do seu espaço de trabalho, não ao local onde o modelo é executado O Orkas mantém as conversas, as configurações dos agentes e as chaves na sua máquina por predefinição, enquanto a chamada ao modelo é enviada para o fornecedor que escolher. Veja como isto funciona na aplicação, na página agente de IA com prioridade aos dados locais.
Descarregar o Orkas — grátis

O que significa realmente "prioridade ao funcionamento local"

O termo vem da conceção de software em geral, não da IA. De forma simplificada, uma aplicação que dá prioridade ao funcionamento local tem três propriedades:

  1. Os seus dados ficam no seu dispositivo por predefinição. Documentos, histórico, configurações — a fonte da verdade é um ficheiro no seu próprio disco, não uma linha numa base de dados remota.
  2. A aplicação funciona na sua máquina. As principais funcionalidades são executadas localmente; não exigem uma comunicação de ida e volta com um servidor para funcionar.
  3. A rede é opcional, não a base. A sincronização, a partilha e a colaboração são funcionalidades que pode ativar, e não a base fundamental da aplicação. Desative-as e a aplicação continuará a funcionar.

Compare isto com o modelo SaaS que dá prioridade à nuvem, em que o servidor é a fonte da verdade e o seu dispositivo é apenas uma janela para ele. Feche a tampa do portátil ao usar uma aplicação que dá prioridade à nuvem e, para começar, os seus dados nunca serão realmente seus; sempre estiveram alojados na infraestrutura do fornecedor, sujeitos aos seus termos, acessíveis aos seus funcionários e mediante intimações. A prioridade ao funcionamento local inverte o ónus da prova: os dados são seus, a menos que decida explicitamente enviar uma cópia para algum lado.

O que muda quando a aplicação é um agente de IA

Quando estas propriedades são aplicadas a uma ferramenta de IA, a escolha do percurso do modelo torna-se uma parte importante da privacidade e do controlo.

Traga a sua própria chave (BYO-key). Na opção BYO, fornece uma chave de API ou uma autenticação OAuth de um fornecedor como a OpenAI, a Anthropic ou a Google. A chave fica no seu dispositivo, e controla o fornecedor, o modelo, os limites e a faturação. Em alternativa, o Orkas também oferece modelos oficiais geridos.

As chamadas BYO vão diretamente para o fornecedor. Quando o agente usa o seu próprio fornecedor, o pedido vai diretamente da sua máquina para esse fornecedor e não passa pelo Orkas. Os modelos oficiais geridos usam o serviço de modelos gerido pelo Orkas.

Vale a pena ser preciso aqui, porque “a IA é executada localmente” é uma interpretação errada comum. A prioridade ao funcionamento local não significa que o próprio modelo é executado no seu portátil (embora possa ser – mais sobre isso abaixo). O modelo ainda pode ser uma API gigantesca na nuvem. O que é local é tudo em torno do modelo: os seus dados, as suas chaves, a configuração do seu agente e o plano de controlo que decide o que enviar e quando. A prioridade ao funcionamento local é uma questão de quem guarda as suas coisas, não de onde está a GPU.

Onde ficam realmente as suas coisas

Concretamente, num agente local como o Orkas, esta é a divisão entre o que permanece onde está e o que pode ser movido.

Por predefinição, na sua própria máquina:

  • As suas chaves de API e tokens OAuth — cifrados em repouso e excluídos de qualquer sincronização.
  • O seu histórico de conversas, planos e ficheiros gerados.
  • As suas configurações, competências e bases de conhecimento do agente.
  • A sua memória pessoal: as preferências e os factos que o agente aprendeu sobre si.

O tratamento das credenciais merece uma análise mais detalhada, porque as chaves são o elemento mais sensível a que uma ferramenta de IA acede. O ciclo de vida de uma chave numa aplicação local bem desenvolvida é curto e delimitado:

1. Você adiciona → cola uma chave de API (ou faz login com OAuth), no dispositivo
2. Criptografado em repouso → selado com AES-256-GCM autenticado antes de tocar no disco
3. Armazenado localmente → gravado em um arquivo de configuração privado da máquina, excluído da sincronização
4. Usado diretamente → descriptografado na memória apenas para ligar para seu provedor, direto da sua máquina

Na opção BYO, a chave não é enviada ao Orkas, nem em repouso, nem em trânsito, nem na telemetria. (A cifragem autenticada, como a AES-256-GCM, também torna a adulteração detetável; protege contra a divulgação acidental – um registo perdido, uma cópia de segurança que executa OCR, outra aplicação a ler a pasta – que é a ameaça realista para um segredo no disco.)

O que ainda sai — e só por sua ordem

"Prioridade ao funcionamento local" não significa "nada sai da sua máquina". Isso seria uma aplicação inútil – e uma afirmação desonesta. A forma honesta de o apresentar é: as coisas só saem quando pede e para os destinos que escolheu. Uma ferramenta local fiável explicita exatamente quais são. Para Orcas:

  • O modelo faz chamadas ao seu próprio fornecedor. Os seus prompts e respostas circulam diretamente entre o seu computador e o fornecedor que escolheu. Saem da sua máquina, mas vão para o seu fornecedor, não para o Orkas.
  • Chamadas do conector que autoriza explicitamente. Quando liga o GitHub, o Notion, o Google e assim por diante, essas chamadas vão da sua máquina para esse serviço. Os tokens OAuth são armazenados no seu dispositivo; para alguns fornecedores que substituem os seus tokens a cada renovação, a etapa de renovação é coordenada através do Orkas para que os seus dispositivos não entrem em conflito entre si — uma exceção deliberadamente restrita, documentada abertamente.
  • Sincronização na nuvem, se a ativar. A sincronização entre vários dispositivos é opcional. Ative-a e os dados que escolher sincronizar serão armazenados nos servidores do Orkas para ficarem disponíveis nos seus dispositivos. Deixe-a desativada e nada será sincronizado.
  • Análises limitadas e que respeitam a privacidade. Eventos de utilização agregados (quais as funcionalidades usadas) — nunca os seus prompts, conteúdos de ficheiros, textos de mensagens ou credenciais.

Na opção BYO, a sua chave fica no dispositivo e o tráfego vai diretamente para o fornecedor. Os modelos oficiais geridos e outras funcionalidades selecionadas da nuvem usam serviços do Orkas.

Porque é importante dar prioridade ao funcionamento local

Isto não é uma encenação de privacidade. A predefinição de que “as suas coisas continuam a ser suas” proporciona várias vantagens concretas.

Soberania de dados. As suas conversas, os ficheiros que um agente lê e grava, a base de conhecimento que construiu — ficam no seu disco, sob o seu controlo. Pode fazer cópias de segurança, inspecioná-los ou eliminá-los sem pedir autorização a ninguém. Não há nenhuma base de dados de fornecedores que contenha a cópia canónica.

Auditabilidade. Com o seu próprio fornecedor, pode ler o cliente de código aberto, observar a rede e confirmar o percurso direto do pedido. As funcionalidades geridas têm um percurso diferente e documentado através dos serviços do Orkas.

Escolha de modelo. Pode usar modelos oficiais geridos ou ligar o seu próprio fornecedor e mudar os modelos quando necessário.

Transparência de custos. As funcionalidades geridas consomem créditos Orkas; a utilização da sua própria chave é faturada diretamente pelo fornecedor.

Resiliência. Como o núcleo é executado na sua máquina e os seus dados são locais, basta uma interrupção ou um e-mail a anunciar a descontinuação do produto para perder o seu trabalho? Com esta ferramenta, não.

Prioridade ao armazenamento local versus um modelo totalmente local — um esclarecimento

Há uma distinção que causa confusão com frequência suficiente para merecer uma secção própria. "IA com prioridade ao armazenamento local", "IA no dispositivo" e "executar um LLM local" são conceitos relacionados, mas não são a mesma coisa.

  • Executar um LLM local (com algo como Ollama) significa que os pesos do modelo são executados no seu equipamento. Nada – pedido ou resposta – sai da sua máquina. Oferece a máxima privacidade, mas está limitado pelo seu equipamento, pelo que os modelos são mais pequenos do que os modelos de ponta na nuvem.
  • A IA com prioridade ao funcionamento local trata de onde os dados do espaço de trabalho, as chaves e o plano de controlo residem por predefinição. O tráfego do modelo segue o percurso escolhido: os modelos oficiais geridos usam os serviços do Orkas, enquanto as chamadas ao seu próprio fornecedor seguem diretamente para ele.

Por isso, complementam-se em vez de competir: uma ferramenta local que também suporta um modelo local oferece o nível de privacidade mais elevado disponível, enquanto a mesma ferramenta ligada a uma API na nuvem oferece capacidades de ponta, mantendo os seus dados sob o seu controlo. A prioridade ao armazenamento local é a arquitetura; um modelo local é um dos motores que pode usar nela.

Como saber se uma ferramenta de IA dá realmente prioridade ao armazenamento local

A designação é usada de forma imprecisa, por isso aqui fica uma pequena lista de verificação que pode aplicar a qualquer ferramenta que a use. Pergunte:

  • Onde ficam os dados do espaço de trabalho por predefinição? Dar prioridade ao armazenamento local significa que o dispositivo é a fonte de verdade por predefinição.
  • Quais caminhos de rede existem? Uma ferramenta fiável distingue as chamadas BYO diretas dos modelos geridos, da sincronização, dos conectores e da análise de dados.
  • A sincronização exige ativação explícita? Os dados permanecem locais até ativar deliberadamente a sincronização.
  • Posso verificar as afirmações? Os clientes de código aberto permitem inspecionar o código e o comportamento da rede.
  • Que percurso do modelo quero usar? O BYO oferece tráfego e faturação diretos pelo fornecedor; os modelos geridos trocam esse percurso por conveniência e créditos Orkas.

Para concluir

A IA com prioridade ao armazenamento local define as predefinições: os dados do espaço de trabalho e o controlo começam na sua máquina, enquanto cada funcionalidade opcional de rede tem um percurso declarado. No Orkas, os modelos oficiais geridos usam os serviços do Orkas e as chamadas ao seu próprio fornecedor seguem diretamente para ele.

Se quiser ver exatamente como isto é implementado — o ciclo de vida da chave, a encriptação, a lista precisa do que fica e do que sai — leia a página Segurança e Confiança; como o cliente é de código aberto, nada disto tem de ser aceite com base na confiança. E se quiser conhecer a engenharia por detrás do próprio agente, veja como um único agente é criado para funcionar de forma fiável na sua máquina e como um agente líder coordena uma equipa de subagentes.