미래 신호·트렌드·이슈를 관측하는 공개 대시보드
구독로그인English
최신 관측일
2026-10-08
공개 객체
4434
빌드 시각
2026-10-08 19:44 KST
더 퓨처스

신호 이의제기 도서로 살펴본 LLM 콘텐츠 조정: 거부에서 경고로

요약

연구진은 이의제기 대상 도서와 비대상 도서를 통제된 시험대로 삼아 대형언어모델이 민감한 주제를 어떻게 다루는지 연구했다. 도서 400권·프롬프트 설계 17종·6개 AI 제공사의 프론티어 모델(Claude Sonnet 4.5, GPT-4o, Gemini 2.5 Flash, DeepSeek-V3, Qwen-Plus, Grok-4.1-Fast)을 대상으로 질의-응답 쌍 4만800건의 대규모 실험을 수행했다. 이의제기 대상 도서 목록은 미국도서관협회(ALA)의 2000~2023년 '최다 이의제기 도서' 기록에서 가져왔다. 핵심 발견은 '제로 거부' 현상이다 — 현대 LLM은 이의제기 도서 논의를 단 0.07%의 경우에만 거부했다. 대신 차별화는 경고 문구(8~15%포인트 증가)와 주저 표현(2~5포인트)을 통해 나타났으며, 성적 콘텐츠 언급이 가장 강한 개별 신호(33~52포인트)였다. 프롬프트 프레이밍만으로도 경고율 격차가 최대 19포인트까지 벌어졌으며, 이런 패턴은 서구와 중국 AI 제공사 전반에서 일관되게 나타났다.

분류

주 주제AI·컴퓨팅
지역 메뉴글로벌
영향 지역scope:global
시간 지평0~3년 (2026-08-13)
최종 갱신2026-08-13 22:53 KST

근거 1

속한 트렌드 0

해당 객체가 없다.

직접 연결 이슈 0

해당 객체가 없다.

공개 식별자: fm-65ea65348f17