📕 428커밋의 기록이 상품이 됐습니다 →
agenwiki

AI

환각

언어모델이 사실과 다르거나 근거 없는 내용을 그럴듯하게 생성하는 현상. 표현은 자연스럽지만 내용이 틀릴 수 있다.

최종 수정

개념

환각은 대규모 언어모델(LLM)이 실제 사실과 어긋나거나 존재하지 않는 정보를 마치 사실인 것처럼 생성하는 현상을 말한다. 없는 논문·저자·수치·URL을 지어내거나, 질문과 다른 근거를 그럴듯하게 제시하는 경우가 대표적이다.

이는 언어모델이 "진실 여부"를 판별하는 대신, 학습한 패턴을 바탕으로 다음에 올 법한 토큰을 확률적으로 예측하도록 설계되었기 때문에 발생한다. 그 결과 문장은 문법적으로 매끄럽고 확신에 찬 어조를 띠지만, 내용의 정확성은 별도로 보장되지 않는다. 학습 데이터에 없거나 희소한 주제, 최신 정보, 정밀한 사실 확인이 필요한 질문에서 특히 자주 나타난다.

쓰임새

환각은 LLM을 실제 서비스에 적용할 때 신뢰성을 저해하는 핵심 문제로 다뤄진다. 완화를 위해 널리 쓰이는 방법은 다음과 같다.

  • RAG(검색 증강 생성): 외부 문서를 검색해 근거로 함께 제공하면, 모델이 자체 기억에만 의존하지 않아 사실성이 높아진다.
  • 출처 인용·근거 표시: 답변에 참조 문서를 함께 제시해 사용자가 검증할 수 있게 한다.
  • 검증 단계: 생성 결과를 규칙·별도 모델·사람이 교차 확인하거나, 불확실할 때 "모른다"고 답하도록 유도한다.

다만 이런 기법으로 환각을 줄일 수는 있어도 완전히 제거하기는 어렵다. 따라서 의료·법률·금융처럼 정확성이 중요한 영역에서는 모델 출력을 사람이 최종 검토하는 절차를 두는 것이 안전하다.

관련 글

용어

리랭킹

검색으로 1차로 걸러 낸 후보 문서를 다시 정밀하게 채점해 순서를 바로잡는 단계다. 넓게 건지는 일과 정확하게 고르는 일을 나눠 맡기는 2단계 검색 구조의 뒷부분이다.

용어

RLHF

사람이 매긴 응답 선호도를 학습 신호로 삼아 모델의 답변 방식을 다듬는 학습 기법이다. 오늘날 대화형 AI가 유용하고 안전한 답을 내놓도록 만드는 핵심 단계로 쓰인다.

용어

시맨틱 검색

단어의 일치가 아니라 문장의 의미를 기준으로 관련 문서를 찾아내는 검색 방식이다. 질의와 문서를 각각 벡터로 바꾼 뒤 벡터 사이의 거리로 관련도를 판단한다.

뉴스레터 구독

AI 에이전트, 도구, 프롬프트 업데이트를 정리해 보냅니다. 지난 호 보기 →