AI는 아무리 똑똑해져도 컨텍스트가 다 차면 무용지물인걸까?

AI는 아무리 똑똑해져도 컨텍스트가 다 차면 무용지물인걸까?

AI 컨텍스트 윈도우는 꽉 차기 훨씬 전부터 정확도가 떨어집니다. 컨텍스트 로트와 중간 유실이 생기는 이유, 2026년 7월 기준 주요 모델 상한, 그리고 대화가 길어졌을 때 성능을 되돌리는 다섯 가지 요령을 정리했습니다. 긴 대화에서 AI가 자꾸 앞을 잊는다면 지금 확인해보세요.

AI가 성능평가 문제를 완벽히 다 풀면, 그 뒤엔 누가 AI를 평가할까?

AI가 성능평가 문제를 완벽히 다 풀면, 그 뒤엔 누가 AI를 평가할까?

AI가 MMLU 같은 벤치마크를 95% 넘게 풀어버린 2026년, 사람은 이제 무엇으로 AI를 평가할까요? 평가자가 피평가자보다 약해지는 ‘역량 역전’의 순간과, LLM-as-a-judge·토론·계층적 평가 같은 대안을 정리했습니다. AI 성능 발표를 곧이곧대로 믿기 전에 꼭 읽어보세요.

GPT-6 아스트라가 나왔는데, GPT-5.6 솔·테라·루나는 이제 뭘 쓰면 될까? — 4개 모델 가격·성능·용도

GPT-6 아스트라가 나왔는데, GPT-5.6 솔·테라·루나는 이제 뭘 쓰면 될까? — 4개 모델 가격·성능·용도

9월 3일 나온 GPT-6 아스트라는 솔보다 2.5배 비싸고, 솔·테라·루나는 7월보다 값이 내려갔습니다(루나는 5분의 1). 네 모델의 가격·컷오프·용도를 한 표로 비교하고, 솔의 11월 21일 프로모션 기한과 아스트라의 Critical 사이버 등급이 무엇을 뜻하는지 정리했습니다.