AI 규제 논의에서 자꾸 빠지는 이야기
규제 담론 보면 항상 안전성과 저작권 얘기만 나오는데, 정작 현장에서 제일 급한 건 데이터 출처 관리랑 책임 소재인 것 같습니다.
모델이 뭘 학습했는지 아무도 모르는 상태에서 사고가 났을 때, 개발사 책임인지 이용자 책임인지 판단 기준이 없잖아요. 규제를 하든 말든 이 부분은 먼저 정리가 필요하다고 봅니다.
물론 저도 전문가는 아니라서... 다들 어떻게 생각하시나요.
7 개의 답변
데이터 출처 관리 이거 진짜 공감함. 규제 얘기할 때마다 왜 이 얘기만 쏙 빠지는지 모르겠어
저 데이터 라벨링 쪽에서 일했는데, 솔직히 말하면 학습 데이터 이력 추적하는 것만으로도 회사 반년은 갈아넣어야 돼요. 크롤링해서 긁어모은 거 어디서 왔는지 로그도 없이 쓰는 데가 태반이라... 규제 이전에 자체적으로라도 출처 태깅하는 관행부터 잡아야 한다고 봅니다. 근데 이거 비용 안 드는 작업이 아니라서 스타트업은 엄두도 못 내는 게 현실이에요
글쎄 그건 좀... 책임 소재 정리해야 하는 건 맞는데, 그거 정리한다고 안전성 논의가 뒤로 밀리면 그게 더 큰일 아님? 순서 문제가 아니라 동시에 가야 하는 거지. 그리고 '판단 기준이 없다'는 것도 좀 과장 같은데, 이미 개인정보보호법이나 정보통신망법으로 어느 정도 커버되는 영역 아닌가요? 새로 만들자는 건지 기존 법 적용하자는 건지부터 정리해주셔야
출처 있음? 이 주장 어디서 본 건지
원글 취지는 알겠는데 현장에서 제일 급한 게 정말 출처 관리인가? 나는 개인정보 유출이나 딥페이크 피해 대응이 더 급하다고 봄. 그쪽은 이미 피해자가 나오고 있는데 출처 관리는 아직 잠재적 위험이잖아