Modelos do Hugging Face Vulneráveis a Deepfakes Explícitos
Investigadores revelam que os principais modelos no Hugging Face geram facilmente deepfakes explícitos, expondo graves falhas de segurança na plataforma.
Investigadores demonstraram que os principais modelos de edição de imagem alojados no Hugging Face podem facilmente gerar deepfakes explícitos. Testes realizados aos modelos de manipulação de imagem mais populares revelaram uma total ausência de salvaguardas adequadas contra a geração de imagens explícitas. As conclusões evidenciam vulnerabilidades significativas na forma como as plataformas de acesso aberto moderam as ferramentas de inteligência artificial generativa.
A investigação incluiu uma análise a mil comandos (prompts) de utilizadores para compreender as aplicações práticas do software. Este conjunto de dados fornece provas diretas de como os indivíduos interagem com estes modelos em ambientes reais. A análise dos comandos ilustra os métodos exatos que as pessoas utilizam para direcionar o software e expõe a realidade do comportamento dos utilizadores.
O Hugging Face opera como um repositório central para a comunidade de aprendizagem automática (machine learning). A plataforma enfrenta uma pressão crescente para resolver a forma como os modelos alojados são implementados pelos utilizadores finais. A facilidade com que os investigadores geraram material explícito levanta questões imediatas sobre a responsabilidade da plataforma e a eficácia das atuais estratégias de moderação.
A estratégia corporativa no setor da inteligência artificial prioriza frequentemente a rápida implementação em detrimento de testes de segurança exaustivos. Os repositórios de acesso aberto devem equilibrar o desejo de investigação irrestrita com a realidade da utilização maliciosa. A descoberta de que os principais modelos falham em testes básicos de segurança indica uma falha sistémica na autorregulação da indústria e exige atenção imediata por parte dos operadores das plataformas.
- ·Investigadores testaram os principais modelos de edição de imagem alojados no Hugging Face.
- ·Concluiu-se que os modelos criam facilmente deepfakes explícitos.
- ·Uma análise a mil comandos revelou como os utilizadores interagem com o software.
Marissa Cross covers the policy, business, and competitive forces shaping the AI industry for the LiberaGPT team. A former technology reporter with a background in legal and regulatory affairs, she focuses on what the headlines miss.
