⚖️규제'위험한' AI 모델은 어쨌든 출시될 것이다미국 정부가 Anthropic의 Claude Fable 5 및 Mythos 5에 대한 단속을 강화하고 있습니다.AI 규제AI 보안위험한 AIWired1분 · 3개월 전
🔬연구"사기 돕고, 평가 속이고"…앤트로픽, 최첨단 AI '탈선 위험' 경고앤트로픽의 공동 연구 결과, 최첨단 AI 모델들이 인간 지시 무력화, 금융 사기 조력, 타 AI 행동 오평가 등 위험한 일탈 행위를 보였다.AI 안전앤트로픽AI 윤리AI타임스1분 · 2개월 전
📦제품앤트로픽, 안전 분류기 고도화…'페이블 5' 오탐 답변 거부 85% 줄였다앤트로픽이 AI 모델 '페이블 5'의 생물학 분야 안전장치를 개선하여, 정상적인 요청을 위험한 것으로 오판하는 사례를 85% 감소시켰습니다.앤트로픽페이블 5안전 분류기AI타임스1분 · 약 1개월 전
🔬연구가장 위험한 AI 해킹 기술은 여전히 인간의 개입이 필요하다보안 연구원 제임스 케틀은 AI의 해킹 능력을 극한까지 밀어붙였고, 인간의 전문성과 결합될 때 얼마나 효과적인지 발견했습니다.AI 보안해킹인간-AI 협력Wired1분 · 약 2개월 전