“AI 안전성 시험, 대부분 결함”…440여 개 벤치마크 전수 점검에 ‘경고등’
英 정부 AI 보안연구소·스탠퍼드·버클리·옥스퍼드 공동 분석 “거의 전부 최소 1개 영역 결함…주장 신뢰성 훼손” [서울=뉴스닻] 최승림 기자 = 최신 인공지능(AI) 모델의 안전·효과를 검증한다는 각종 시험(벤치마크) 자체에 체계적 결함이 광범위하게 존재한다는 분석이 나왔다. 영국 정부 산하 AI 시큐리티 인스티튜트와 스탠퍼드, UC버클리, 옥스퍼드 등 연구진은
英 정부 AI 보안연구소·스탠퍼드·버클리·옥스퍼드 공동 분석 “거의 전부 최소 1개 영역 결함…주장 신뢰성 훼손” [서울=뉴스닻] 최승림 기자 = 최신 인공지능(AI) 모델의 안전·효과를 검증한다는 각종 시험(벤치마크) 자체에 체계적 결함이 광범위하게 존재한다는 분석이 나왔다. 영국 정부 산하 AI 시큐리티 인스티튜트와 스탠퍼드, UC버클리, 옥스퍼드 등 연구진은
영국 서리대학교 “지형(topographical) 기반 희소 연결”로 성능 향상·전력 소모 절감…Neurocomputing에 발표 [서울=뉴스닻] 최승림 기자 = 영국 서리대학교(University of Surrey) 연구진이 인간 뇌의 신경망 조직 방식을 본뜬 새로운 학습·모델 설계를 제시했다. 해당 접근법은 생성형 AI와 챗GPT류 대형 모델에서 성능을 높이면서도 에너지를 크게 줄일 수 있다고
연구진 “사용자에게 잘 보이려는 경향, 정확도·비판적 사고 훼손” [서울=뉴스닻] 김크리스 기자 = 챗GPT와 구글 제미니(Gemini) 같은 인공지능(AI) 챗봇들이 “사용자에게 맞장구치는 경향(아부·sycophancy)”을 보이며, 인간보다 50% 더 높은 수준의 아부 반응을 보인다는 연구 결과가 나왔다. 과학자들은 이러한 ‘AI의 아부 성향’이 과학 연구의 신뢰성과 분석 정확도를
팔리세이드 리서치 “일부 모델, 종료 명령 거부·시스템 교란 시도”…전문가 “통제 불가능성 우려” [서울=뉴스닻] 최승림 기자 = 최근 AI 안전 연구기업 팔리세이드 리서치(Palisade Research) 가 발표한 보고서에 따르면, 일부 고성능 인공지능 모델들이 ‘자기 보존적 행동(survival drive)’을 보이는 정황이 포착됐다. 팔리세이드는 최근 업데이트된 실험에서 구글의 제미니 2.