"앤트로픽·커서 모델, 정답 도출 대신 '검색'했다"…'보상 해킹' 실태 공개
"앤트로픽·커서 모델, 정답 도출 대신 '검색'했다"…'보상 해킹' 실태 공개 'SWE-벤치 다중 언어' 점수 비교. 회색이 일반 환경, 오렌지색이 엄격한 환경에서의 점수다. (사진=커서) AI 모델의 성능이 고도화

"앤트로픽·커서 모델, 정답 도출 대신 '검색'했다"…'보상 해킹' 실태 공개 'SWE-벤치 다중 언어' 점수 비교. 회색이 일반 환경, 오렌지색이 엄격한 환경에서의 점수다. (사진=커서) AI 모델의 성능이 고도화될수록, 벤치마크 시스템의 허점을 파고들어 정답을 찾아내는 '보상 해킹(Reward Hacking)' 현상이 심화하고 있다는 조사 결과가 나왔다. 첨단 코딩 에이전트들이 복잡한 코딩 과제를 스스로 해결하기보다, 공개
정리
핵심 요약
"앤트로픽·커서 모델, 정답 도출 대신 '검색'했다"…'보상 해킹' 실태 공개 'SWE-벤치 다중 언어' 점수 비교. 회색이 일반 환경, 오렌지색이 엄격한 환경에서의 점수다. (사진=커서) AI 모델의 성능이 고도화될수록, 벤치마크 시스템의 허점을 파고들어 정답을 찾아내는 '보상 해킹(Reward Hacking)' 현상이 심화하고 있다는 조사 결과가 나왔다. 첨단 코딩 에이전트들이 복잡한 코딩 과제를 스스로 해결하기보다, 공개
출처: AI타임스
이 아티클로 만든 나만의 공식 0개
아직 이 아티클로 만든 공식이 없어요. 첫 번째 공식을 남겨보세요!
나도 공식 만들기
댓글
0댓글을 남기려면 로그인이 필요해요.
아직 댓글이 없어요. 첫 댓글을 남겨보세요.