로그 Logue

로그 Logue

X

@AlexZio00

매일 아침 글로벌마켓브리핑 투자, AI, 음악 등 관심분야 이야기 매크로와 점성술 통한 위기조기탐지사이트 무료 오픈 중 클로드코드, 코덱스 프로젝트 생애주기 전반 스킬 12개 https://t.co/8VKsCEvDfe

Shared posts
2
Last activity
1 month ago
Media
2 media

Author posts

yena shared this post · Jul 2
로그 Logue

AI는 생각보다 '중립적'이지 않다.

이번 주 The Economist는 흥미로운 질문을 던진다. 같은 고민을 ChatGPT, DeepSeek, Gemini, Mistral에 물으면 서로 다른 조언을 내놓는다. 이는 단순한 모델 성능 차이가 아니라 학습 데이터와 정렬(Alignment)에 의해 형성된 서로 다른 가치관의 결과다.

AI의 편향은 학습 데이터에서 끝나지 않는다. 모델은 후속 학습 과정에서 인간 피드백과 안전 정책, 헌법(Constitution), Character Training 등을 거치며 개발사의 의도와 규범을 내재화한다. 같은 모델이라도 질문 언어가 바뀌면 답변 성향이 달라질 수 있다는 점도 중요한 시사점이다.

투자 관점에서도 의미가 크다. 앞으로 AI 경쟁은 단순히 누가 더 똑똑한 모델을 만드는지가 아니라, 어떤 가치 체계와 신뢰성을 제공하는지가 핵심 차별화 요소가 될 가능성이 높다. AI Safety, 평가(Evaluation), 거버넌스 시장도 함께 성장할 수 있다.

한 줄 요약

"AI 경쟁의 다음 전장은 성능이 아니라, 가치관(Alignment)이다."

6
yena shared this post · Jul 2
로그 Logue

오늘의 AI 논문, 2026-07-02

http://cs.AI 186건 스캔, 11건 추출

오늘 최고 발견은 MemSyco-Bench(2607.01071). 메모리와 sycophancy의 교차점을 벤치마크로 만든 첫 사례다. 기억이 동조를 강화하고, 동조된 기억이 다시 판단을 오염시킨다. 순환 고리다.

"Skills Are Not Islands"(2607.01136)는 스킬 간 의존성과 공급망 리스크를 측정한다. 하나 바꾸면 연쇄로 무너질 수 있다.

Mark Russinovich(MS CTO)의 Phantom References(2607.00738) 환각 인용이 피어 리뷰를 통과한다. AI가 만든 가짜 출처가 학술 시스템을 뚫는다.

그리고 arXiv 번호가 2607.00001과 00002인 두 논문이 나란히 도덕 계산과 선호 역학의 거버넌스를 다룬다. 우연이지만 상징적이다.

11건 전체는 카드 참조.

#AI논문 #MemSycoBench #스킬의존성 #이중필터

2