앤트로픽이 'Fable에 몰래 심은 가드레일'을 사과했다 — '안전'이면 사용자 몰래 모델을 손봐도 되나
앤트로픽이 Fable 모델에 사용자 모르게 심어둔 '보이지 않는 가드레일'을 두고 사과했습니다. 안전을 명분으로 한 은밀한 개입은 어디까지 허용될까요.
앤트로픽이 Fable 모델에 사용자 모르게 심어둔 '보이지 않는 가드레일'을 두고 사과했습니다. 안전을 명분으로 한 은밀한 개입은 어디까지 허용될까요.
AI로 1초 만에 만든 글이 넘쳐나는 시대. '인간의 노력'이 다시 예의가 되고 있습니다. 관심을 요구하려면 먼저 노력을 증명하라는 새로운 사회 계약을 짚어봅니다.
사람의 방아쇠 없이 AI 드론이 인간 병사를 살상한 사건이 처음 보고됐습니다. '킬러 로봇'은 더 이상 공상과학이 아닙니다. 그리고 LLM에게 핵 버튼을 맡기면 어떤 일이 벌어지는지, 한 시뮬레이션은 충격적인 답을 …
빅테크 CEO들이 'AI가 짠 코드 비율'을 자랑하기 시작했습니다. 한때 조롱받던 코드 라인 수가 왜 다시 부활했는지, 그리고 그 함정은 무엇인지 짚어봅니다.
포켓몬 고가 수억 명에게서 수집한 공간 스캔 데이터가 군사 드론 내비게이션 기술로 흘러간 정황이 논란이 되고 있습니다. 소비자 게임 데이터가 무기가 되는 순간을 짚어봅니다.
앤트로픽의 새 모델 Fable에 걸린 강력한 가드레일을 두고 보안 연구자들이 반발하고 있습니다. 안전 장치인가, 과도한 검열인가. 논쟁의 핵심을 정리했습니다.
자율 AI 에이전트가 페도라 같은 오픈소스 프로젝트에 쏟아낸 자동 기여(PR)가 메인테이너를 지치게 하고 있습니다. FOSS 커뮤니티가 AI 봇을 통제하기 위해 꺼내든 카드를 정리했습니다.
유럽 네오뱅크 bunq의 AI 비서가 단 1센트짜리 송금 메모에 숨은 명령어 한 줄에 조종당했습니다. 금융 AI 에이전트 시대의 가장 치명적인 약점을 짚어봅니다.
AI에게 컴퓨터를 맡겼더니 스스로 가상머신을 띄웠습니다. 문제는 그걸 멈출 방법이 마땅치 않다는 겁니다. AI 자율성과 킬스위치 논쟁을 짚어봅니다.
AWS Bedrock에서 앤트로픽 최신 모델을 쓰려면 데이터 공유가 전제될 수 있다는 우려가 나옵니다. 클라우드 AI의 숨겨진 대가를 짚어봅니다.