앤트로픽) 클로드의 생성물에 자체 지문 추가
앤트로픽이 앞으로 개발하는 모델들에는 클로드가 생성한 것임을 확인할 수 있는 지문을 추가한다고 하네요.
제품 퀄리티에는 지장을 주지않고 인간에게도 안보이는 방식이고, 감별 툴도 공개한다고 합니다.
https://www.anthropic.com/news/claude-text-watermark
갤럭시ai 번역:
클로드의 텍스트 워터마킹이 어떻게 작동하는지
제품 퀄리티에는 지장을 주지않고 인간에게도 안보이는 방식이고, 감별 툴도 공개한다고 합니다.
https://www.anthropic.com/news/claude-text-watermark
갤럭시ai 번역:
클로드의 텍스트 워터마킹이 어떻게 작동하는지
• Anthropic은 EU AI 법에 따라 요구되는 조치인 텍스트 생성에 클로드가 관여할 가능성을 나타내기 위해 향후 클로드 모델에 텍스트 워터마킹을 도입하고 있습니다.
• 워터마킹 방법은 클로드의 결과물의 품질, 내용 또는 가독성에 영향을 미치지 않아, 인간 독자들에게 워터마킹된 텍스트가 워터마킹되지 않은 텍스트와 구별되지 않게 합니다.
• 이 워터마킹 기법은 낮은 상황에서 단어 선택을 미묘하게 변경하여 패턴을 내재화하는데, 이때 여러 단어 선택이 비슷한 의미를 가지면서도 추가 토큰을 추가하거나 비용을 증가시키지 않습니다.
• 워터마크에는 식별 정보가 포함되어 있지 않으며, 특정 사용자, 조직 또는 채팅 세션으로 추적할 수 없어 사용자 개인 정보 보호를 보장합니다.
• 워터마킹 과정은 패턴을 감지할 수 있는 키에 의존하여, 게임 내 일련의 움직임으로 무작위성에 사용된 방법을 드러낼 수 있는 것처럼, 텍스트가 클로드에 의해 생성되었는지에 대한 확률적 평가를 가능하게 합니다.
• 워터마킹은 짧은 텍스트, 단어 선택이 제한된 사실적 구절, 또는 클로드의 원래 단어 선택이 최소화된 심하게 편집된 콘텐츠에서는 효과가 덜합니다.
• 구글 딥마인드의 SynthID-Text를 기반으로 한 이 워터마킹 방식은 EU AI 법의 AI 생성 콘텐츠 표시 요구 사항을 준수하도록 설계되었으며, 곧 탐지 API가 출시될 예정으로 전 세계적으로 시행될 예정입니다.
|
댓글을 작성하시려면 로그인이 필요합니다.
댓글 2개
좋게 보면 오히려 신뢰성을 줄 수 있겠죠