<aside> 🧭 AI가 쓰다 보면 점점 답답해진다고 느껴질 때, 왜 그런지와 그럴 때 뭘 하면 되는지를 한 페이지에 정리했어요.
</aside>
전부 AI 회사가 스스로 공개한 사고예요. 모델 자체가 멍청해진 게 아니라, 모델을 돌리는 방식에서 문제가 생긴 경우가 대부분이에요.

2025년 8~9월 장애가 발견되고(노랑), 악화되고(빨강), 고쳐진(초록) 시점 타임라인 (이미지 ©앤트로픽 공식 보고서)
클로드 일부 요청이 100만 토큰짜리 초장문 처리용 서버로 잘못 전달돼 답변 품질이 떨어졌어요. 8월 5일 시작돼 8월 말 서버 배분 방식이 바뀌면서 더 심해졌고, 클로드 코드 사용자 약 30%가 한 번 이상 영향을 받았어요. 모델 이름은 그대로인데 요청이 가는 길이 달랐던 거죠.
출처: 앤트로픽 2025년 9월 17일 장애 보고서
위 타임라인의 두 번째 줄에 해당하는 사고예요. TPU 서버 설정 문제로 평소엔 거의 안 나올 글자에 높은 확률이 붙으면서, 영어 질문에 태국어·중국어 글자가 섞이고 코드에 문법 오류가 생겼어요. 9월 2일 설정을 되돌려 해결했고, 이후 배포 전에 이런 오류를 잡는 검사를 추가했어요.
출처: 앤트로픽 2025년 9월 17일 장애 보고서

클로드 코드가 사용자에게 띄운 실제 안내 화면 — '대부분 작업엔 중간(medium) 강도를 권장한다'고 알렸어요 (이미지 ©앤트로픽 공식 보고서)
답이 늦어 화면이 멈춘 것처럼 보이는 문제를 줄이려고, 앤트로픽은 클로드 코드의 기본 추론 강도를 '높음'에서 '중간'으로 낮췄어요. 그러자 '덜 똑똑해졌다'는 반응이 쏟아졌고, 한 달 뒤 사용자들이 더 높은 지능을 기본으로 원한다는 이유로 원래대로 되돌렸어요.

생각 강도를 높일수록 답은 좋아지지만 느려지고 사용량이 늘어나는 관계 (이미지 ©앤트로픽 공식 보고서)
같은 모델이어도 생각에 쓰는 자원을 조절하면 사용자가 체감하는 문제 해결 능력이 달라질 수 있다는 걸 보여주는 사례예요.
출처: 앤트로픽 2026년 4월 23일 품질 문제 보고서

왼쪽이 의도한 동작(쉬었다 재개할 때 한 번만 정리), 오른쪽이 실제 버그(그 뒤 매 대화 차례마다 정리) (이미지 ©앤트로픽 공식 보고서)
1시간 넘게 쉰 대화를 다시 열 때 옛 추론 기록을 한 번 정리하려던 기능이, 버그 때문에 그 뒤 매 대화 차례마다 작동했어요. 그래서 AI가 맥락을 잊거나 같은 말을 반복하고, 엉뚱한 도구를 고르는 것처럼 보였죠. 사용량 한도가 빨리 닳는 부작용도 있었어요. 모델을 바꾸지 않아도 대화 관리 방식이 경험을 망가뜨릴 수 있다는 사례예요.
출처: 앤트로픽 2026년 4월 23일 품질 문제 보고서