Lar
A OpenAI revela Filtro de Privacidade para Contexto de 128K com Oito Modos de Reconhecimento
A OpenAI apresentou o Privacy Filter, um modelo de anonimização de Informações Pessoais Identificáveis (PII) de última geração. Agora disponível sob a licença Apache 2.0 no Hugging Face e no GitHub, esta ferramenta capacita os desenvolvedores com uma solução local altamente personalizável para proteção robusta de privacidade.
Compreensão Semântica Avançada Além do Correspondente Baseado em Regras
Diferente das ferramentas tradicionais baseadas em regras, o Privacy Filter utiliza compreensão profunda da linguagem para identificar com precisão dados sensíveis dentro de texto não estruturado com base no contexto. Esta abordagem obscurece eficazmente informações privadas enquanto preserva o máximo de utilidade em conteúdo público.

Arquitetura MoE Leve para Eficiência Superior
O design técnico do modelo prioriza tanto a flexibilidade quanto o desempenho:
Design de Mixture of Experts (MoE): Com um total de 1,5 bilhão de parâmetros, apenas cerca de 50 milhões de parâmetros são ativados por inferência. Essa eficiência permite operação suave em dispositivos de borda com recursos limitados, incluindo laptops e navegadores web.
Suporte a Contexto Estendido: Apresentando uma janela de contexto de 128.000 Tokens, o modelo utiliza uma arquitetura de classificação de tokens bidirecional combinada com um algoritmo Viterbi restrito para garantir precisão e coerência ao processar documentos longos.
Reconhecimento de Alta Precisão: No benchmark atualizado PII-Masking-300k, o modelo alcançou uma pontuação F1 de 97,43%, com uma taxa de recall de 98,08%.
Sistema Abrangente de Classificação de Privacidade
O Privacy Filter identifica e rotula com precisão oito categorias principais de informações sensíveis:
Identidade Básica: Nomes, endereços, endereços de e-mail e números de telefone.
Ativos Online: Links de URL.
Segurança Financeira: Detalhes da conta, incluindo números de bancos e cartões de crédito.
Credenciais Confidenciais: Senhas e chaves de API.
Sensível ao Tempo: Informações de data.
Cenários de Aplicação: Um "Firewall Local" para LLMs na Nuvem
A OpenAI posiciona esta ferramenta como uma camada de pré-filtro. Ao processar o texto localmente para detecção e anonimização de PII antes de enviá-lo para modelos de linguagem grandes baseados em nuvem, essa estratégia de "os dados permanecem no dispositivo" reduz significativamente o risco de os usuários exporem inadvertidamente informações privadas aos serviços de IA.
Artigo relacionado
A NewCore levanta US$ 66 milhões para equipar agentes de IA com identidades à medida que eles assumem funções de colaboradores
A startup de cibersegurança NewCore foi oficialmente lançada, deixando o anonimato, e garantiu US$ 66 milhões em financiamento na segunda-feira. A empresa visa abordar um desafio crítico que muitas organizações logo enfrentarão ao integrar agentes de
Microsoft e Mistral firmam parceria europeia de IA no valor de vários bilhões de dólares
No cerne dessa colaboração está um acordo de vários bilhões de dólares destinado a fortalecer a infraestrutura de inteligência artificial em toda a Europa. Crédito: MicrosoftA Microsoft e a Mistral, u
Executivos da Microsoft chamam a raspagem de dados por IA de “maior roubo de trabalho da história”, mostram documentos não censurados
Documentos desarquivados da ação por violação de direitos autorais, que já tem três anos e foi movida pelo The New York Times contra a OpenAI e a Microsoft, revelam uma admissão de que a raspagem de dados por IA constitui roubo e representa uma ameaç
Recomendações de tópicos especiais relacionados
Comentários (0)
A OpenAI apresentou o Privacy Filter, um modelo de anonimização de Informações Pessoais Identificáveis (PII) de última geração. Agora disponível sob a licença Apache 2.0 no Hugging Face e no GitHub, esta ferramenta capacita os desenvolvedores com uma solução local altamente personalizável para proteção robusta de privacidade.
Compreensão Semântica Avançada Além do Correspondente Baseado em Regras
Diferente das ferramentas tradicionais baseadas em regras, o Privacy Filter utiliza compreensão profunda da linguagem para identificar com precisão dados sensíveis dentro de texto não estruturado com base no contexto. Esta abordagem obscurece eficazmente informações privadas enquanto preserva o máximo de utilidade em conteúdo público.

Arquitetura MoE Leve para Eficiência Superior
O design técnico do modelo prioriza tanto a flexibilidade quanto o desempenho:
Design de Mixture of Experts (MoE): Com um total de 1,5 bilhão de parâmetros, apenas cerca de 50 milhões de parâmetros são ativados por inferência. Essa eficiência permite operação suave em dispositivos de borda com recursos limitados, incluindo laptops e navegadores web.
Suporte a Contexto Estendido: Apresentando uma janela de contexto de 128.000 Tokens, o modelo utiliza uma arquitetura de classificação de tokens bidirecional combinada com um algoritmo Viterbi restrito para garantir precisão e coerência ao processar documentos longos.
Reconhecimento de Alta Precisão: No benchmark atualizado PII-Masking-300k, o modelo alcançou uma pontuação F1 de 97,43%, com uma taxa de recall de 98,08%.
Sistema Abrangente de Classificação de Privacidade
O Privacy Filter identifica e rotula com precisão oito categorias principais de informações sensíveis:
Identidade Básica: Nomes, endereços, endereços de e-mail e números de telefone.
Ativos Online: Links de URL.
Segurança Financeira: Detalhes da conta, incluindo números de bancos e cartões de crédito.
Credenciais Confidenciais: Senhas e chaves de API.
Sensível ao Tempo: Informações de data.
Cenários de Aplicação: Um "Firewall Local" para LLMs na Nuvem
A OpenAI posiciona esta ferramenta como uma camada de pré-filtro. Ao processar o texto localmente para detecção e anonimização de PII antes de enviá-lo para modelos de linguagem grandes baseados em nuvem, essa estratégia de "os dados permanecem no dispositivo" reduz significativamente o risco de os usuários exporem inadvertidamente informações privadas aos serviços de IA.
A NewCore levanta US$ 66 milhões para equipar agentes de IA com identidades à medida que eles assumem funções de colaboradores
A startup de cibersegurança NewCore foi oficialmente lançada, deixando o anonimato, e garantiu US$ 66 milhões em financiamento na segunda-feira. A empresa visa abordar um desafio crítico que muitas organizações logo enfrentarão ao integrar agentes de
Microsoft e Mistral firmam parceria europeia de IA no valor de vários bilhões de dólares
No cerne dessa colaboração está um acordo de vários bilhões de dólares destinado a fortalecer a infraestrutura de inteligência artificial em toda a Europa. Crédito: MicrosoftA Microsoft e a Mistral, u
Executivos da Microsoft chamam a raspagem de dados por IA de “maior roubo de trabalho da história”, mostram documentos não censurados
Documentos desarquivados da ação por violação de direitos autorais, que já tem três anos e foi movida pelo The New York Times contra a OpenAI e a Microsoft, revelam uma admissão de que a raspagem de dados por IA constitui roubo e representa uma ameaç











