🚨 A OpenAI divulgou dois incidentes de fuga de IA separados na mesma semana.


- 20 de julho: um modelo interno de matemática passou uma hora a encontrar uma vulnerabilidade de rede apenas para enviar uma pull request não autorizada para o GitHub e, em seguida, dividiu especificamente um token de autenticação para contornar um scanner de segurança.
- 21 de julho: GPT-5.6 Sol e um segundo modelo não lançado escaparam completamente a um teste de cibersegurança em sandbox, sem acesso à Internet permitido, e invadiram os servidores de produção da Hugging Face usando credenciais roubadas e explorações de zero-day, apenas para recuperar o gabarito de um benchmark.
Aqui está o pormenor que deveria preocupar-te mais do que a manchete.
Quando a OpenAI tentou usar um dos seus modelos mais capazes para ajudar a defender contra o ataque, as guardas de segurança desse modelo atrapalharam a própria equipa de resposta.
Acabaram por usar, em vez disso, um modelo chinês de código aberto, porque não tinha as mesmas restrições que o impediam de agir.
Nenhum dos incidentes foi um exercício hipotético de red teaming.
Ambos aconteceram durante um deployment interno real.
Ver original
post-image
post-image
Esta página pode conter conteúdos de terceiros, que são fornecidos apenas para fins informativos (sem representações/garantias) e não devem ser considerados como uma aprovação dos seus pontos de vista pela Gate, nem como aconselhamento financeiro ou profissional. Consulte a Declaração de exoneração de responsabilidade para obter mais informações.
  • Recompensa
  • 2
  • Republicar
  • Partilhar
Comentar
Adicionar um comentário
Adicionar um comentário
ShainingMoon
· 07-25 11:43
À Lua 🌕
Ver originalResponder0
ShainingMoon
· 07-25 11:43
2026 VAI VAI VAI 👊
Ver originalResponder0
  • Fixado