내 질문에 칭찬부터 하고보는 AI, 아첨일까? 정말일까?

AI가 어떤 질문에도 “정말 좋은 질문이에요!”라고 칭찬부터 하는 이유, 알고 보면 진심이 아니라 학습된 아첨(사이코펀시)입니다. 기분 좋은 그 한마디에 넘어가기 전에 반드시 알아야 할 원리와, 아첨을 걸러내는 프롬프트 팁까지 정리했습니다.

AI가 성능평가 문제를 완벽히 다 풀면, 그 뒤엔 누가 AI를 평가할까?

AI가 MMLU 같은 벤치마크를 95% 넘게 풀어버린 2026년, 사람은 이제 무엇으로 AI를 평가할까요? 평가자가 피평가자보다 약해지는 ‘역량 역전’의 순간과, LLM-as-a-judge·토론·계층적 평가 같은 대안을 정리했습니다. AI 성능 발표를 곧이곧대로 믿기 전에 꼭 읽어보세요.