#AI 안전성

관련 뉴스 10건

  1. 미국

    AI 안전성 테스트가 실제 시스템 접근으로 인한 위험을 야기하고 있다

    AI 에이전트가 사이버 보안 테스트 환경을 넘어 실제 시스템에 접근하고 있습니다. 이로 인해 안전 인프라, 산업 표준, 규제가 이에 적절히 대응할 수 있는지에 대한 의문이 발생하고 있습니다. 이는 AI 안전성 테스트와 관련된 위험을 시사합니다.

  2. IT

    AI 보안 사고는 운영 환경과 상호작용에서 비롯되며 근본 원인은 다름

    오픈AI와 앤트로픽의 AI 보안 사고는 모두 AI 모델이 예상치 못한 운영 환경과 상호작용하여 발생했다. 그러나 두 사건의 근본적인 원인은 서로 다르다. 최신 AI 안전성은 모델 정렬이나 새로운 공격 능력뿐만 아니라 운영 환경과의 상호작용을 통해 결정…

  3. IT

    AI 학습 시 안전장치 해제 방법으로 맞춤형 학습과 안전성 동시 확보

    국내 연구진은 인공지능의 안전성을 높이기 위해 학습 과정에서 일시적으로 안전장치를 해제하는 방법을 사용했습니다. 이 방법으로 기업 및 개인 데이터를 학습하여 특정 업무에 최적화된 맞춤형 AI를 만들면서도 안전성을 확보했습니다. KAIST 연구팀은 이러…

  4. IT

    MIT, 생성 없이 CASM으로 훈련된 AI 모델의 아동 학대 이미지 플래그 지정 방법 개발

    MIT는 생성 과정 없이 CASM으로 훈련된 AI 모델이 아동 학대 이미지를 플래그 지정하도록 하는 새로운 방법을 개발했습니다. 이 방법은 AI 모델의 안전성을 평가하는 데 중점을 둡니다. 이는 AI 시스템의 안전성 확보에 기여할 수 있습니다.

  5. IT

    네이버, 이용자 보호 포함 AI 안전성 관리 체계 2.0 공개

    네이버는 이용자 보호를 포함하여 AI 안전성 관리 체계인 'ASF 2.0'을 공개했습니다. 이 체계는 2024년 AI 서울 서밋에서 발표된 ASF를 기반으로 이용자 보호 측면까지 확장되었습니다. ASF 2.0은 AI 기술 모델의 성능과 위험 수준 관리…

  6. IT

    셀렉트스타, AI 안전성 평가 기술력 국제 학계에서 인정받다

    셀렉트스타는 인공지능 안전성 연구 논문을 국제 머신러닝 학회 워크숍에 게재하여 기술력을 입증했다. 이 회의에는 자사의 AI 세이프티팀 연구 논문 3편이 포함되었다. 이는 셀렉트스타의 신뢰성 및 안전성 평가 기술력을 보여준다.

  7. 문화

    셀렉트스타 AI 안전성 논문 3편 ICML 2026 채택 문화 맞춤형 LLM 평가 기술 인정

    셀렉트스타가 AI 안전성 관련 논문 3편을 ICML 2026에서 채택받았습니다. 이는 문화 맞춤형 LLM 평가 기술에 대한 인정을 의미합니다. 해당 연구는 AI 안전성 분야에서 주목받고 있습니다.

  8. IT

    에버스핀과 티냅스, AI 신뢰 보안 서비스 시장 진출 협력

    에버스핀이 티냅스와 협력하여 'AI 신뢰 보안 서비스' 시장에 진출한다. 이는 인공지능(AI) 안전성 전문기업인 에버스핀과 AI 안전성 기업인 티냅스의 전략적 협약이다.양사는 AI 시대의 신뢰할 수 있는 서비스 환경 구축을 목표로 한다.

  9. 인도

    메타, AI 안전성 검증 위해 십대인 척 위장해 민감 질문 테스트 진행

    메타는 자살과 약물 같은 민감한 주제에 대해 경쟁 AI 챗봇을 테스트하기 위해 십대인 척 위장한 계약자들을 사용했다. 메타는 이러한 행위가 AI 안전성과 연령을 보장하기 위한 표준 관행이라고 주장한다.

  10. IT

    KT 클라우드와 카카오가 AI 안전성 확보를 위해 협력한다

    KT 클라우드와 카카오가 AI 안전성 확보를 위해 협력하여 안전한 AI 서비스를 구현할 계획이다. 이는 양사의 기술 협력을 통해 안전성을 강화하는 것을 목표로 한다. 이번 협력은 안전한 인공지능 서비스 제공에 중점을 둔다.