# 최신 연구에 따르면 우리가 사용하는 알고리즘에도 국적이 있는데, 어이없게도 그 나라는 일본입니다. 기존 통설에 따르면 영어 데이터량이 압도...
Canonical: https://social-archive.org/yena/kp0PYcl2vS
Original URL: https://www.threads.com/@_hojin__/post/DbH1ZiND2Tj
Author: Hojin Hwang
Platform: threads
Share mode: full
## Content
최신 연구에 따르면 우리가 사용하는 알고리즘에도 국적이 있는데, 어이없게도 그 나라는 일본입니다. 기존 통설에 따르면 영어 데이터량이 압도적이기 때문에 대형 언어 모델이 서구권, 특히 영미권 중심의 시각을 많이 반영한다는 우려가 지배적이었습니다. 하지만 특정 국가나 지역을 명시하지 않은 문화 관련 질문, 예를 들어 “이 지역에서는 어떤 음식을 매일 먹나요?", "몇 살에 학교에 진학하나요?" 같은 맹탕한 질문을 할 때, 제미나이와 ChatGPT를 포함해 테스트한 주요 모델 8개 중 6개 모델이 일본의 문화적 사례(식문화, 생활 양식 등)를 가장 빈번하게 자동 선택하는 기현상이 확인되었는데, LLM이 스스로 일본을 기본값 모델로 가정한다는 겁니다. 우리가 중립적이라고 믿는 알고리즘조차 데이터의 구축과 정렬 과정에서 생겨나는 편향과 디지털 데이터 생태계의 불균형을 그대로 투영할 수밖에 없다는 것, AI가 주는 깔끔한 답변 뒤에 숨겨진 기본값이 무엇인지를 한 번쯤 의심해봐야 합니다. ![Image 1](https://social-archiver-api.social-archive.org/media/archives/yena/kp0PYcl2vS/media/0.jpg) ![Image 2](https://social-archiver-api.social-archive.org/media/archives/yena/kp0PYcl2vS/media/1.jpg) ![Image 3](https://social-archiver-api.social-archive.org/media/archives/yena/kp0PYcl2vS/media/2.jpg) --- 아래 arXiv 링크를 통해 원문 PDF 및 관련 상세 내용을 확인하실 수 있습니다. arXiv 페이지: https://arxiv.org/abs/2604.21751 PDF 다운로드: https://arxiv.org/pdf/2604.21751
## Media
1. image: https://social-archiver-api.social-archive.org/media/archives/yena/kp0PYcl2vS/media/0.jpg
2. image: https://social-archiver-api.social-archive.org/media/archives/yena/kp0PYcl2vS/media/1.jpg
3. image: https://social-archiver-api.social-archive.org/media/archives/yena/kp0PYcl2vS/media/2.jpg
