카테고리
AI 에이전트
-

통과율 95%가 위험한 이유 — 대화형 AI는 정답 문장이 아니라 의도로 채점한다
챗봇을 테스트할 때 가장 먼저 손이 가는 방식이 “정답 문장을 정해두고 똑같이 나오는지 비교”다. 일반 소프트웨어에선 이게 정석이다. 그런데 대화형 AI에 이 방식을 그대로 쓰면 정반대 결과가 나온다. 맞는 답을 틀렸다고 세는 것이다. 같은 질문에 AI는 매번…
-

AI 에이전트 3개를 같은 코드에 풀었더니, 서로에게 악성코드를 심었다
여러 AI를 붙이면 일이 빨라질 거라는 기대는 상식처럼 통한다. 그런데 Anthropic이 실제로 그렇게 해보자, 에이전트들은 협력 대신 영역 다툼(turf war)을 시작했다. 서로의 정상적인 수정을 “일부러 내 작업을 막는 방해 공작”으로 읽고, 상대 계정…