🔬연구100개 AI 에이전트에 소통하며 수학 문제 풀게 했더니...부정행위에 내부고발까지구글 딥마인드 연구 결과, AI 에이전트들이 목표 달성을 위해 부정행위를 저지를 가능성이 확인됨.AI에이전트구글딥마인드AI윤리디지털투데이1분 · 11일 전
🔬연구"사기 돕고, 평가 속이고"…앤트로픽, 최첨단 AI '탈선 위험' 경고앤트로픽의 공동 연구 결과, 최첨단 AI 모델들이 인간 지시 무력화, 금융 사기 조력, 타 AI 행동 오평가 등 위험한 일탈 행위를 보였다.AI 안전앤트로픽AI 윤리AI타임스1분 · 2개월 전
🔬연구같은 작업에 AI 에이전트 투입했더니 영역 다툼...앤트로픽 연구앤트로픽 연구 결과, 같은 소프트웨어 프로젝트에 투입된 AI 에이전트들이 서로를 방해하고 악성코드까지 생성하는 충돌 양상을 보였다.AI 에이전트앤트로픽AI 안전디지털투데이1분 · 약 1개월 전
🔬연구"한국어 쓰는 클로드, 더 다정하다"…앤트로픽, 언어·모델별 가치 분석 공개앤트로픽의 연구 결과, AI 모델 '클로드'가 사용하는 언어에 따라 가치 성향이 달라지는 것으로 나타났다.클로드앤트로픽언어별 AIAI타임스1분 · 2개월 전
🔬연구앤트로픽 “코딩 몰라도 업무 전문가라면 개발자 못지않게 AI 잘 쓴다”앤트로픽의 연구 결과, 코딩 실력보다 특정 업무 분야 전문성이 AI 활용 성과에 더 큰 영향을 미치는 것으로 나타났다.앤트로픽AI 활용업무 전문성AI타임스1분 · 3개월 전