A corrida pela supremacia da IA soberana: Equilibrando privacidade de dados e inovação

1 de novembro de 2024 Luciano Bertene

A corrida pela supremacia da IA não é apenas uma competição entre as grandes empresas de tecnologia, mas também inclui nações soberanas. O Fórum Econômico Mundial define IA soberana como "a capacidade de uma nação de construir IA com talentos locais... com base em sua política local ou estratégia nacional de IA". De um ponto de vista macroeconômico, político e de segurança, fica claro por que os países precisam construir capacidades avançadas de IA dentro dos limites de suas fronteiras.

A definição de IA soberana no nível da empresa

No nível micro, a definição de IA soberana é um tanto análoga à competência de uma empresa de tecnologia. Pegue a definição acima e troque as palavras "nação" por "organização", e o significado confina a IA soberana às fronteiras de empresas individuais. A IA soberana então se torna uma vantagem competitiva da empresa, como mostrado por sua capacidade de ajustar modelos e incutir segurança e confiança em aplicações de IA.

Mas como você garante a privacidade dos dados quando a maneira mais fácil de consumirIA generativa(GenAI) está usando um modelo fechado sobre uma API de nuvem?

Problema de privacidade de dados da GenAI

Considere como um desenvolvedor de software pode construir um chatbot simples de perguntas e respostas hoje. Eles provavelmente começariam baixando uma estrutura de modelo de linguagem grande (LLM) como o LangChain e seguindo um dos tutoriais do LangChain . Em pouco tempo, os dados confidenciais da sua empresa e talvez até mesmo as informações de identificação pessoal (PII) dos seus clientes são enviados para a OpenAI para recuperar embeddings de texto e gerar respostas de chat, então armazenados em um banco de dados vetorial também hospedado na nuvem.

Agentes e sistemas de IA agênticos sem dúvida tornam a privacidade de dados ainda mais difícil. Eles têm autonomia para tomar decisões e executar ações sem serem solicitados por um humano. Então, sem governança adequada, seria difícil rastrear quais dados sensíveis estão sendo compartilhados fora da sua organização.

Para ser claro, isso não é necessariamente um problema. Depende de quão permissiva é a política de privacidade e proteção de dados da sua empresa. Mesmo assim, empresas como a OpenAI levam a privacidade de dados muito a sério e cumprem com padrões de segurança de dados reconhecidos internacionalmente, como SOC2 e General Data Protection Regulation (GDPR) para manter os dados seguros dentro de seus sistemas. Isso pode ser o suficiente para satisfazer sua equipe de InfoSec, mas quais são suas opções se seus dados confidenciais devem permanecer estritamente dentro dos limites de sua rede?

Invertendo o paradigma: traga o modelo para seus dados

Mark Zuckerberg diz: " A IA de código aberto é o caminho a seguir ". Em seu artigo, ele defende o uso dos modelos Llama da Meta, que ela define como de código aberto , como a melhor opção para aproveitar o poder do GenAI porque o software de código aberto, por sua natureza transparente, é mais seguro e confiável do que alternativas de código fechado.

O ponto saliente aqui é que modelos como o Llama podem ser executados em qualquer lugar. Isso é bom para empresas que não querem dar seus dados proprietários porque elas podem levar o modelo para seus dados, e não o contrário. A chave para que isso permaneça verdadeiro é que não haja modelos de breakout que sejam 10 vezes melhores que os demais, essencialmente desbloqueando novos casos de uso que não eram possíveis antes.

O compromisso declarado da Meta com o código aberto destaca o Llama como uma das principais escolhas hoje, mas outros modelos chamados de código aberto merecem uma menção honrosa, incluindo o Gemma e o Mistral do Google, entre outros. No entanto, os modelos abertos não são a única maneira de resolver o problema de privacidade de dados com o GenAI.

Empresas como a Cohere dão suporte a implantações privadas e implantações " traga sua própria nuvem " (BYOC) que permitem que você implante seus LLMs em sua conta de nuvem e nuvem privada virtual (VPC). Se seus dados confidenciais já estiverem protegidos na nuvem, então BYOC é outra maneira de levar o modelo e outras ferramentas de plataforma de dados para onde seus dados já residem.

Grátis Vs. Livre

Llama e outros modelos similares podem ser gratuitos para baixar e usar, mas o custo prático de executar um LLM de fronteira em sua própria infraestrutura certamente não é gratuito. Não vou calcular os custos de processamento de tokens neste artigo, mas basta dizer que as GPUs Nvidia H100 não são baratas, e você precisará de mais de uma H100 para executar o modelo de parâmetro 405B do Llama em uma escala útil.

Então, esse é o preço que você deve pagar pela privacidade de dados na era GenAI?

Há sempre um equilíbrio, e o contra-argumento é que nem todo modelo precisa executar inferência em GPUs para ter um bom desempenho. Llama é, na verdade, uma coleção de modelos — um rebanho de lhamas, se preferir — que são pré-treinados e ajustados em vários tamanhos. O menor é um modelo de parâmetro 1B leve o suficiente para ser executado em um dispositivo móvel para coisas como resumo de texto. As pessoas salvam muitos dados confidenciais em seus celulares, então ser capaz de executar inferência diretamente em um dispositivo é importante do ponto de vista da privacidade.

O modo e o tamanho do modelo que você usa dependem do caso de uso, mas saiba que há opções para criar aplicativos GenAI que nem sempre exigem hardware muito caro para inferência.

O veredito: a privacidade não está morta

Claro, a privacidade de dados não está morta na era da IA. A solução para o problema da privacidade de dados sempre foi a mesma. Se você tem dados sensíveis e sua política de privacidade de dados determina que os dados não podem ser compartilhados fora da sua organização, então o software que entra em contato com esses dados tem que rodar dentro da sua rede, GenAI ou não.

O que muda é a economia. Se você não pode compartilhar dados com um modelo fechado por uma API de nuvem ou simplesmente não confia no provedor de modelo fechado, então você tem que descobrir uma maneira de fornecer acesso a um LLM dentro de sua rede. Existem provedores de modelo fechado como o Cohere que suportam implantações privadas na nuvem ou no local, e o Meta apresenta um argumento convincente para os chamados modelos de código aberto como o Llama.

Segurança de dados, privacidade de dados e soberania de dados não devem proibir a adoção da tecnologia GenAI na empresa. Modelos de código aberto estão constantemente melhorando e, à medida que modelos menores se tornam mais poderosos e o ecossistema de ferramentas ao redor deles cresce, aplicativos construídos na tecnologia GenAI podem ser os ativos mais poderosos da sua organização.

Conteúdo relacionado

Prolog vs. Lisp: Explorando a Programação Lógica e Funcional

A escolha da linguagem de programação certa pode fazer toda a diferença no desenvolvimento de aplicativos complexos e sistemas inteligentes. Neste post, vamos mergulhar na comparação entre duas abo...
Haskell vs. OCaml: Escolhendo a Linguagem Funcional Ideal para o seu Projeto

Na era da computação moderna, onde a eficiência e a confiabilidade são cruciais, a escolha da linguagem de programação certa pode fazer toda a diferença. Neste artigo, vamos explorar as característ...
Dylan vs. Smalltalk: Programação Dinâmica e Orientada a Objetos

Quando se trata de linguagens de programação, a diversidade é abundante, cada uma com suas próprias características, forças e aplicações específicas. Neste blog, vamos mergulhar na comparação entre...
JRuby vs. Groovy: Desenvolvimento JVM Dinâmico

A escolha entre JRuby e Groovy pode ser um desafio para desenvolvedores que trabalham em ambientes Java. Ambas as linguagens oferecem vantagens únicas, mas é importante entender as diferenças para ...
V vs. Zig: Linguagem Certa para Desenvolvimento de Sistemas e Segurança

Na era digital em constante evolução, a escolha da linguagem de programação certa se torna cada vez mais crucial para o desenvolvimento de sistemas eficientes e seguros. Neste artigo, vamos explora...
Crystal vs. Nim: Desenvolvimento de Sistemas e Performance

O mundo do desenvolvimento de software está em constante evolução, e as linguagens de programação desempenham um papel fundamental nesse cenário. Duas linguagens que têm ganhado destaque são o Crys...
Tcl vs. Expect: Explorando as diferenças na Automação de Tarefas

A evolução da tecnologia trouxe consigo uma série de ferramentas e linguagens de programação que visam facilitar a automatização de tarefas. Neste cenário, duas opções se destacam: Tcl (Tool Comman...
Idris vs. Agda: Explorando a Programação Funcional e a Tipagem Dependente

No mundo em constante evolução da tecnologia, a busca por linguagens de programação cada vez mais poderosas e seguras é uma prioridade. Neste cenário, duas linguagens se destacam: Idris e Agda. Amb...
Jai vs. Odin: Linguagem Certa para Desenvolvimento de Sistemas de Alto Desempenho

Quando se trata de desenvolvimento de sistemas e aplicações de alto desempenho, a escolha da linguagem de programação certa pode fazer toda a diferença. Neste post, vamos explorar duas opções promi...
Jai vs. V: Qual a melhor linguagem para desenvolvimento de sistemas de alto desempenho?

A escolha da linguagem de programação certa pode fazer uma grande diferença no desempenho e eficiência de um sistema. Neste post, vamos comparar duas linguagens emergentes, Jai e V, que estão se de...
Pony vs. Ponylang: Concorrência e o Desenvolvimento de Sistemas

A indústria de tecnologia está em constante evolução, e as linguagens de programação desempenham um papel fundamental nesse cenário. Duas linguagens que têm chamado a atenção são o Pony e o Ponylan...
Q# vs. Qiskit: Diferenças no Desenvolvimento de Computação Quântica

A computação quântica tem sido um campo em rápida evolução, com diversas linguagens e frameworks surgindo para permitir que desenvolvedores explorem esse novo paradigma computacional. Neste post, v...
TypeScript vs. Dart: Quam melhor para Desenvolvimento de Aplicativos Web e Móveis?

A escolha entre TypeScript e Dart é uma decisão importante para qualquer desenvolvedor que esteja construindo aplicativos web e móveis. Ambas as linguagens oferecem recursos poderosos e têm suas pr...
Q# vs. Qiskit: Diferenças no Desenvolvimento de Computação Quântica

A computação quântica tem sido um campo em rápida evolução, com diversas linguagens e frameworks surgindo para atender às necessidades dos desenvolvedores. Neste artigo, vamos explorar duas das pri...
AutoIt vs. AutoHotkey: Ferramentas Poderosas para Automação de Tarefas no Windows

Neste mundo digital em constante evolução, a necessidade de automatizar tarefas rotineiras e aumentar a produtividade é cada vez mais evidente. Duas ferramentas que se destacam nesse cenário são o ...
C++20 vs. Rust: Desenvolvimento de Sistemas e Segurança

A evolução das linguagens de programação é um tópico fascinante, especialmente quando se trata de comparar duas abordagens tão distintas como C++20 e Rust. Ambas as linguagens desempenham papéis cr...
Haxe vs. CoffeeScript: Melhor Opção para Desenvolvimento Multiplataforma

Na era digital em constante evolução, a escolha da linguagem de programação certa pode fazer toda a diferença no sucesso de um projeto. Duas opções que têm se destacado no cenário do desenvolviment...
Lua vs. JavaScript: Linguagens para Desenvolvimento de Jogos e Scripts

Quando se trata de desenvolvimento de jogos e scripts, a escolha da linguagem de programação certa pode fazer toda a diferença. Duas opções populares neste cenário são Lua e JavaScript, cada uma co...
Haxe vs. Dart: Escolhendo a melhor opção para Desenvolvimento Multiplataforma

Quando se trata de desenvolvimento multiplataforma, duas linguagens de programação se destacam: Haxe e Dart. Ambas oferecem soluções poderosas para criar aplicativos que funcionam em diferentes pla...
Vala vs. C#: Linguagem para Desenvolvimento de Aplicativos Linux e Windows

Ao escolher uma linguagem de programação para o desenvolvimento de aplicativos, é importante considerar as características e os recursos oferecidos por cada uma. Neste artigo, vamos comparar duas l...
Groovy vs. Java: Desenvolvimento de Aplicativos Dinâmicos

Quando se trata de desenvolvimento de aplicativos, os programadores têm uma variedade de opções à sua disposição. Duas linguagens de programação que têm se destacado nesse cenário são o Groovy e o ...
F# vs. Scala: Programação Funcional e Orientada a Objetos

A escolha da linguagem de programação certa pode fazer uma grande diferença no sucesso de um projeto. Neste artigo, vamos explorar as características e aplicações de duas linguagens populares: F# e...
Common Lisp vs. Scheme: Explorando a Programação Funcional Acadêmica

A programação funcional tem sido um campo fascinante na ciência da computação, com linguagens como Common Lisp e Scheme desempenhando papéis importantes no desenvolvimento dessa paradigma. Neste ar...
Groovy vs. JRuby: Escolhendo a Linguagem Dinâmica Ideal para o seu Projeto JVM

A escolha da linguagem de programação certa pode fazer uma grande diferença no sucesso de um projeto de software. Quando se trata de desenvolvimento JVM (Java Virtual Machine), duas opções dinâmica...
Smalltalk vs. Ruby: Qual a Melhor Linguagem de Programação Orientada a Objetos?

Quando se trata de desenvolvimento de software, a escolha da linguagem de programação é fundamental. Duas opções que têm se destacado no cenário do desenvolvimento orientado a objetos são o Smallta...
Dylan vs. Common Lisp: Explorando a Programação Dinâmica e Funcional

A escolha da linguagem de programação certa pode fazer toda a diferença no desenvolvimento de sistemas complexos. Neste artigo, vamos explorar duas opções poderosas: Dylan e Common Lisp. Ambas ofer...
Pascal vs. Delphi: Linguagem para Desenvolvimento de Aplicativos Desktop

Na era digital em constante evolução, a escolha da linguagem de programação certa pode fazer toda a diferença no desenvolvimento de aplicativos desktop. Duas opções que têm se destacado nesse cenár...
OCaml vs. F#: Comparando Linguagens Funcionais e de Tipagem Estática

Na era da computação moderna, onde a eficiência e a confiabilidade são cruciais, as linguagens de programação funcionais e de tipagem estática têm se destacado como opções poderosas. Neste artigo, ...
TypeScript vs. JavaScript: Tipagem Estática e Escalabilidade

Em 2025, a adoção de TypeScript deve aumentar em projetos de grande escala. Como uma superset do JavaScript, o TypeScript adiciona recursos de tipagem estática, melhorando a segurança e escalabilid...
Go vs. Python: Concorrência e Simplicidade

Em 2025, a escolha entre Go e Python para desenvolvimento de back-end e sistemas distribuídos se torna cada vez mais relevante. Ambas as linguagens possuem características únicas que as tornam atra...
Go vs. Java: Concorrência e Escalabilidade

Go (ou Golang) e Java são duas linguagens amplamente utilizadas para o desenvolvimento de aplicações robustas e de alta performance. No entanto, quando o assunto é concorrência e escalabilidade, ca...
Rust vs. C++: Segurança vs. Performance

Em 2025, a escolha entre Rust e C++ continua sendo um tópico de grande debate entre desenvolvedores de software. Ambas as linguagens são conhecidas por sua ênfase na performance, mas Rust se destac...
Kotlin vs. Java: Desenvolvimento Android Moderno em 2025

Em 2025, o desenvolvimento de aplicativos Android continua a evoluir rapidamente, com a linguagem Kotlin consolidando sua posição como a escolha preferida dos desenvolvedores. Desde que a Google a ...
Julia vs. Python: Velocidade e Análise de Dados

Em 2025, a linguagem de programação Julia está ganhando cada vez mais atenção no mundo da análise de dados e ciência de dados. Embora Python ainda seja a linguagem dominante nessas áreas, Julia vem...
COBOL vs. Visual Basic: Legado e Desenvolvimento Rápido

Nos dias atuais, as empresas enfrentam um desafio constante de equilibrar a necessidade de manter sistemas legados robustos e a demanda por soluções de desenvolvimento rápido e inovadoras. Neste ce...
C# vs. F#: Linguagem Certa para o seu Projeto

Como desenvolvedores, enfrentamos constantemente o desafio de escolher a linguagem de programação mais adequada para nossos projetos. Neste artigo, vamos explorar as diferenças entre C# e F#, duas ...
Kotlin vs. Swift: Qual a Melhor Opção para Desenvolvimento Móvel?

O desenvolvimento móvel é um campo em constante evolução, com duas linguagens de programação dominantes: Kotlin e Swift. Ambas têm suas próprias forças e fraquezas, e a escolha entre elas pode ter ...
MATLAB vs. R: Qual a melhor ferramenta para análise de dados e simulações?

A escolha entre MATLAB e R é uma decisão importante para profissionais que trabalham com análise de dados, modelagem e simulações. Ambas as ferramentas possuem pontos fortes e fracos, e a seleção d...
Elixir vs. Java: Concorrência e Desenvolvimento de Aplicativos

A escolha da linguagem de programação certa pode fazer uma grande diferença no desenvolvimento de aplicativos, especialmente quando se trata de concorrência e escalabilidade. Neste artigo, vamos co...
Clojure vs. Kotlin: Linguagem para seu Desenvolvimento JVM e Concorrência

Na era da computação moderna, onde a complexidade dos sistemas e a necessidade de escalabilidade são cada vez mais desafiadoras, a escolha da linguagem de programação certa pode fazer toda a difere...
Bash vs. Perl: Linguagens de Scripting e Processamento de Texto

Em um mundo cada vez mais automatizado, a escolha da linguagem de script certa pode fazer toda a diferença na eficiência e produtividade de suas tarefas. Neste artigo, vamos explorar as característ...
Python vs. Perl: Análise de Dados e Scripting

A escolha entre Python e Perl é uma decisão importante para muitos profissionais que trabalham com análise de dados e automação de tarefas. Ambas as linguagens têm seus pontos fortes e aplicações e...
Haskell vs. Scala: Programação Funcional e Tipagem Estática

Na era da computação moderna, onde a eficiência e a escalabilidade são cruciais, a escolha da linguagem de programação certa pode fazer toda a diferença. Duas opções que se destacam nesse cenário s...
Assembly vs. C: Baixo Nível e Performance

A escolha entre Assembly e C é uma decisão importante para desenvolvedores que precisam lidar com requisitos de alto desempenho e controle de baixo nível. Ambas as linguagens oferecem vantagens e d...
Scratch vs. Python: Qual a Melhor Linguagem de Programação para Iniciantes?

Quando se trata de aprender a programar, existem diversas opções de linguagens disponíveis, cada uma com suas próprias características e aplicações. Duas das linguagens mais populares para iniciant...
PHP vs. Ruby: Qual a Melhor Opção para Desenvolvimento Web Dinâmico?

Quando se trata de desenvolvimento web dinâmico, duas linguagens de programação se destacam: PHP e Ruby. Ambas têm suas próprias forças e fraquezas, e a escolha entre elas pode fazer uma grande dif...
SQL vs. NoSQL: Solução de Gerenciamento de Dados para sua Empresa

Na era digital em que vivemos, a gestão eficiente de dados tornou-se fundamental para o sucesso de qualquer negócio. Empresas de todos os tamanhos e setores enfrentam o desafio de armazenar, proces...
C vs. Fortran: Desempenho e Simulações Científicas

A escolha da linguagem de programação certa pode fazer uma grande diferença no desempenho e eficiência de aplicações científicas e de engenharia. Duas opções populares neste contexto são C e Fortra...
Integração da Inteligência Artificial no Desenvolvimento de Software: Impulsionando a Inovação e a Eficiência

Em 2025, a Inteligência Artificial (IA) se tornou uma ferramenta indispensável no desenvolvimento de software, transformando a maneira como os programadores trabalham e as soluções que eles criam. ...
Linguagens de Programação em Ascensão: Explorando as Tendências Emergentes

A indústria de tecnologia está em constante evolução, com novas linguagens de programação surgindo e ganhando popularidade a cada ano. Neste blog, vamos explorar algumas das linguagens de programaç...
Ecossistema de Aplicativos: 5 coisas essenciais para se ter dominio

Os ecossistemas de aplicativos estão se expandindo e se tornando mais complexos com o surgimento de aplicativos baseados em IA, esforços de modernização e novas iniciativas. Embora eu não ache que ...
Waymo e o uso do Gemini na Direção Autônoma

A decisão da Waymo de utilizar o Gemini em seu sistema de direção autônoma é significativa por várias razões. Primeiro, ela representa uma mudança no uso de IA generativa e modelos de linguagem de ...
Inteligência Artificial na Produção Siderúrgica: Otimizando Processos e Garantindo Qualidade

A indústria siderúrgica, uma das mais importantes e estratégicas para o desenvolvimento econômico global, enfrenta constantes desafios para manter sua competitividade e eficiência. Nesse cenário, a...