AI 에이전트 연구
Hallucination as a Feature, not a Defect: Evaluating a multi-agent architecture to transform speculative language-model outputs into testable scientific hypotheses
ARarXiv
이 논문은 Rust 기반 다중 에이전트 구조로 언어모델의 추측적 출력을 검증 가능한 과학 가설로 바꾸는 방식을 제안한다.
세 줄 요약
- 고엔트로피 생성 에이전트와 웹 기반 평가 에이전트가 저엔트로피 의미 병목으로 이어지고, 직접 프롬프팅은 대부분 지표에서 가장 약한 편이었다.
- 가설이 강한 물리적, 경험적, 제도적 제약에서 살아남아야 할 때 전체 구조가 이점을 보인다는 점이 실제 조건을 가려 준다.
- 환각이 단독으로 유용하다는 증거는 없으며, 추측 생성은 구조, 경험적 근거, 명시적 평가로 제약될 때만 가치를 얻는다.
이 논문은 Rust 기반 다중 에이전트 구조로 언어모델의 추측적 출력을 검증 가능한 과학 가설로 바꾸는 방식을 제안한다.