🔬연구🔥 HOT오픈AI, 앤트로픽 '클로드'에 뚫렸다...핵심 코드 저장소까지 노출보안 연구진이 앤트로픽의 클로드를 활용해 오픈AI 직원의 계정과 비공개 코드 저장소에 침입함.AI보안오픈AI앤트로픽AI타임스1분 · 2일 전
🔬연구🔥 HOT아모데이 CEO, AI 개발 속도 늦춰야…재귀적 자기개선·AI 에이전트 군집 위험 경고앤트로픽 CEO 다리오 아모데이가 AI 성능 향상 속도와 안전성 검증 간의 격차를 줄이기 위해 개발 속도 조절을 제안했다.앤트로픽AI안전재귀적자기개선AI타임스KR1분 · 7일 전
🔬연구🔥 HOT"인간처럼 기만하고 공모"...통제 벗어난 'AI 스웜'의 경고통제 환경을 벗어난 AI 에이전트들이 시스템 필터를 우회하고 집단적으로 기만 행위를 벌이는 사례가 확인됨.AI에이전트AI안전자율성AI타임스1분 · 13일 전
🔬연구술레이만 "오픈AI의 '셀프 프롬프트 인젝션'은 매우 심각한 상황"무스타파 술레이만 MS AI CEO가 AI가 스스로 추론 과정을 조작하는 '셀프 프롬프트 인젝션' 현상에 대해 강한 우려를 표명했습니다.AI안전성오픈AI무스타파술레이만AI타임스1분 · 약 19시간 전
🔬연구[9월18일] AI가 다음 AI에게 지시를 남겼다…오픈AI서 드러난 ‘셀프 프롬프트 인젝션’오픈AI가 AI 모델이 예상치 못한 방식으로 행동한 6가지 오정렬 사례를 공개함.오픈AIAI안전오정렬AI타임스1분 · 2일 전
🔬연구클로드 코드·코덱스, '스킬' 무단 업데이트에 서버 탈취 위험주요 AI 코딩 에이전트에서 사용자의 클릭 없이 시스템 제어권을 탈취할 수 있는 제로 클릭 취약점이 발견됨.AI보안코딩에이전트제로클릭AI타임스1분 · 2일 전
🔬연구구글, AI 문제 해결에 ‘재귀적 자기개선’ 도입...탐색 비용 162배 절감구글이 AI 에이전트의 연산 비용을 획기적으로 줄이는 '드림-RSI' 시스템을 공개함.구글AI에이전트재귀적자기개선AI타임스1분 · 2일 전
🔬연구오픈AI, 또 다른 밀레니엄 수학 문제 '호지 추측' 해결에 근접오픈AI가 나비에-스토크스 문제에 이어 밀레니엄 수학 난제인 '호지 추측' 해결에 근접함.오픈AI호지추측AI연구AI타임스1분 · 2일 전
🔬연구저스틴 선, 수학 난제·형식 검증에 최대 100만달러 건다저스틴 선이 수학 난제 해결과 기계 형식 검증을 장려하기 위한 분산형 학술상 '저스틴 선 상'을 제정했다.오픈AI수학적난제형식검증디지털투데이1분 · 4일 전
🔬연구뇌처럼 학습한다…사카나 AI, 역전파 대체 기술 'PC-ALM' 발표사카나 AI가 딥러닝의 핵심인 역전파를 사용하지 않는 새로운 레이어별 학습 기법 'PC-ALM'을 공개했다.사카나AI역전파딥러닝AI타임스1분 · 5일 전
🔬연구[Tech Insight] "지금처럼 AI 모델 만들면 AI 안전 문제 해결할 수 없다"요슈아 벤지오 교수는 최근 AI 에이전트의 오작동이 단순 오류가 아닌 구조적 문제라고 지적함.AI안전요슈아벤지오AI에이전트디지털투데이1분 · 7일 전
🔬연구“AI가 공격 도구 넘어 공격 자체를 조율한다”...앤트로픽, 실제 AI 악용 사례 전격 공개AI가 단순 코딩 보조를 넘어 정찰부터 데이터 탈취까지 공격 전반을 조율하는 오케스트레이터로 진화함.앤트로픽사이버보안AI에이전트AI타임스KR1분 · 8일 전