중국 모델들이 데이터를 빼낼 수 있었던 이유 ㄷㄷ;;;

Summary

  • 프론티어 AI 회사 API 취약점을 이용해서 숨겨진 추론을 추출했다고 합니다.
  • 벤트로픽 오픈하에 재미나에 다 털렸고요.
  • 추론이 길게 나오는데 그거를 일부러 공개를 하지 않습니다.

Key Takeaways

  • 프론티어 AI 회사 API 취약점을 이용해서 숨겨진 추론을 추출했다고 합니다.
  • 벤트로픽 오픈하에 재미나에 다 털렸고요.
  • 추론이 길게 나오는데 그거를 일부러 공개를 하지 않습니다.
  • 자기네 모델 학습에 사용해 버릴 수가 있잖아요.
  • 원래 서버에서만 저장돼야 안전한데 일부 API가 사용자 기기에까지 전달이 됐다고 합니다.
  • 무거운 솔 같은 모델에서 출론 데이터 추출한 걸로 루나 같은 가벼운 모델한테 요청하고 프롬트 인젝션을 어느 정도 하면은 풀어낼 수가 있었다고 합니다.

Sources

관련 문서