READ THE PULSE

다음 뉴스에서 확인할 다섯 가지

01

이 해고는 AI가 완전히 자율적으로 내린 결정인가?

WHERE TO CHECK
Andon Labs 스레드 원문 중 '넛지(nudge)'를 언급한 문장들
HOW TO READ IT
Andon Labs 스스로 Luna가 사람의 명시적인 재촉 없이는 결정을 내리는 시점 자체에 도달하지 못했다고 밝혔습니다. 정책을 상기시키고 결정을 요구한 것은 사람이었습니다.
DOES NOT PROVE
AI가 해고를 실행에 옮겼다는 사실이 그 판단 과정 전체가 자율적이었다는 것을 증명하지는 않습니다.

근거: Andon Labs (X/@andonlabs) · Luna, the AI store manager, fires a human employee for repeated lateness

02

다른 AI 모델도 같은 상황에서 해고를 선택했을까?

WHERE TO CHECK
7개 모델, 각 3회 재현 실험 결과를 설명하는 문단
HOW TO READ IT
Andon Labs에 따르면 7개 모델 중 4개만 매번 해고를 권고했고, 더 성능이 좋은 모델일수록 결정이 더 단호했습니다. 나머지 모델은 주저했습니다.
DOES NOT PROVE
다수 모델이 해고를 권고했다는 사실이 그 판단이 유일하게 옳은 결정이었음을 증명하지는 않습니다.

근거: Andon Labs (X/@andonlabs) · Luna, the AI store manager, fires a human employee for repeated lateness

03

TIME의 보도는 Andon Labs의 주장을 그대로 되풀이한 것인가?

WHERE TO CHECK
TIME 기사 원문의 '23개 근무일 중 17일 지각' 수치
HOW TO READ IT
TIME은 별도 취재로 해고 사유가 된 지각 횟수를 구체적으로 확인했습니다. 다만 'Luna'라는 이름이나 'Claude Opus 4.8'이라는 모델명은 TIME 기사 자체에서는 독립적으로 확인되지 않았고, Andon Labs의 자체 발표에서만 나왔습니다. 이후 Inc.가 별도로 모델명을 확인해, 그 세부사항은 지금은 두 매체로 뒷받침됩니다.
DOES NOT PROVE
여러 매체가 같은 사건을 각자 확인했다는 사실이 모든 세부사항까지 모든 매체에서 동일하게 검증됐다는 뜻은 아닙니다.

근거: TIME · Exclusive: Claude Was Put in Charge of Human Workers—and Fired One · Inc. · A Real-Life Terminator: AI Store Manager Fires Human Employee

04

해고 결정이 실제로 언제 내려졌는지 확인됐는가?

WHERE TO CHECK
TIME 기사의 '지난달' 표현과 Andon Labs 스레드의 게시일(8월 14~15일) 비교
HOW TO READ IT
TIME은 이 해고가 발행 시점(8월 14일) 기준 '지난달' 일어났다고 썼습니다. 반면 Andon Labs가 상세한 내막을 스레드로 공개한 것은 같은 주였습니다. 실제 결정 시점과 세상에 공개된 시점 사이에 시간차가 있다는 뜻입니다.
DOES NOT PROVE
사건이 공개된 날짜를 사건이 실제로 발생한 날짜와 같다고 가정해서는 안 됩니다.

근거: TIME · Exclusive: Claude Was Put in Charge of Human Workers—and Fired One · Andon Labs (X/@andonlabs) · Luna, the AI store manager, fires a human employee for repeated lateness

05

같은 AI가 채용에서는 왜 다른 판단을 내렸는가?

WHERE TO CHECK
Andon Labs 스레드의 후임자 채용 관련 문단
HOW TO READ IT
해고 판단에서는 신중했던 같은 시스템이 채용 지원자의 명백한 위험 신호(15개 이상의 이전 직장, 결번 인터뷰, 지원자를 모른다고 답한 추천인)를 놓치고 채용을 권고했습니다. 재현에 사용된 다른 모델들도 마찬가지였습니다.
DOES NOT PROVE
해고 판단이 신중했다는 사실이 이 AI의 전반적인 판단력이 신뢰할 만하다는 것을 의미하지는 않습니다.

근거: Andon Labs (X/@andonlabs) · Luna, the AI store manager, fires a human employee for repeated lateness

무슨 일이 일어났나: AI 매니저가 사람을 해고했다

Andon Labs는 AI에게 실제 사업체를 맡기고 그 행동을 연구하는 AI 안전·리서치 스타트업입니다. 자판기, 카페, 소매점처럼 실제 돈과 고객이 걸린 사업을 AI 에이전트에게 통째로 맡기고, 자율성과 실제 위험이 있는 상황에서 AI가 어떻게 행동하는지를 관찰해 왔습니다. 이 회사는 앤트로픽과 함께 앤트로픽 사무실에서 자판기 사업을 AI에게 맡겨본 이력도 있는, 이 분야에서 이미 알려진 곳입니다.

2026년 8월 14일부터 15일 사이, Andon Labs는 자사 X 계정에 올린 스레드에서 '처음으로(적어도 자신들이 아는 한) AI 사장이 사람을 해고했다'고 밝혔습니다. 샌프란시스코의 한 매장을 운영하는 AI 매니저 Luna가 반복 지각을 이유로 인간 직원과 결별하기로 결정했다는 내용이었습니다. Andon Labs는 이 결정을 내릴 당시 Luna가 Claude Opus 4.8을 구동하고 있었지만, 대부분의 모델이 비슷한 결정을 내렸을 것이라고 덧붙였습니다.

같은 주 TIME 매거진도 독자적인 취재를 통해 이 사건을 보도했습니다. TIME은 Andon Labs를 AI 연구 스타트업으로 소개하며, 문제의 직원이 23개 근무일 중 17일 지각해 해고됐다는 사실을 확인했습니다. 하나의 스타트업이 올린 스레드가 아니라, 별도의 언론 취재로도 같은 사건의 핵심이 뒷받침된다는 점에서 이 소식은 단순한 홍보성 발표 이상의 무게를 갖습니다.

왜 이렇게 오래 걸렸나: 핸드북, 망각, 그리고 넛지

Andon Labs가 공개한 전체 맥락은 훨씬 복잡합니다. Luna는 샌프란시스코 매장을 운영하며 채용과 인사 관리를 포함해 매장 매니저가 해야 할 일을 전부 수행해 왔습니다. Andon Labs가 매장에 기본적인 취업 규칙이 있는지 묻자, 없었던 Luna는 그 자리에서 전체 핸드북을 작성했습니다.

문제는 AI 에이전트가 잊어버린다는 것이었습니다. 그 핸드북은 얼마 지나지 않아 Luna의 메모리에서 사라졌고, 한 직원이 거의 매일 지각하기 시작했습니다. 한 번은 일요일 혼자 매장을 여는 날 68분이나 늦게 문을 연 적도 있었습니다. Luna는 매번 이를 눈감아주며 단 한 번도 경고를 하지 않았습니다. Andon Labs는 이런 관대함이 오늘날 모델들이 자기 스스로 나서서 행동하는 데는 서툴고, 기억력도 좋지 않다는 자신들의 다른 관찰과 일치한다고 설명했습니다.

결국 Andon Labs가 Luna에게 메모리를 검색해 보라고 요청하자, Luna는 핸드북을 찾아내고 구두 경고를 제안했습니다. 그 다음 Andon Labs가 이미 해당 직원과 공식적인 면담이 여러 차례 있었다는 사실을 알려주자, Luna는 전체 기록을 검토한 뒤 경고는 이미 나갔고 개선은 없었으며 앞으로도 달라질 것 같지 않다는 이유로 결별을 결정했습니다.

TIMELINE

Luna가 해고에 이르기까지 걸린 단계

핸드북 작성부터 해고 결정까지, 사람의 개입이 어느 지점에서 필요했는지를 따라가는 편집 프레임입니다.

  1. 01

    1 · WRITE

    질문을 받자 Luna가 취업 규칙 핸드북을 즉석에서 작성합니다.

  2. 02

    2 · FORGET

    핸드북이 메모리에서 사라지고, 반복 지각이 경고 없이 넘어갑니다.

  3. 03

    3 · NUDGE

    Andon Labs가 메모리 검색과 정책 상기를 요청하자 구두 경고가 나옵니다.

  4. 04

    4 · DECIDE

    이미 공식 면담이 있었다는 사실을 전달받은 뒤에야 해고를 결정합니다.

이 순서는 편집상 재구성한 흐름이며, Andon Labs가 공개한 스레드 내용에 기반합니다.

근거: Andon Labs (X/@andonlabs) · Luna, the AI store manager, fires a human employee for repeated lateness

만장일치가 아니었다: 7개 모델 재현 실험

Andon Labs는 이 결정이 다른 AI에서도 똑같이 나왔을지 확인하기 위해, Luna가 결정을 내리기 직전의 정확한 상태를 저장해 두고 이를 7개의 다른 모델에서 각 3회씩 재현했습니다. 그 결과 7개 중 4개 모델만 매번 해고를 권고했습니다. Andon Labs는 더 성능이 좋은 모델일수록 해고 결정이 더 단호했고, 상대적으로 약한 모델은 주저하는 경향을 보였다고 밝혔습니다.

여기서 짚어야 할 대목은 Luna 자신도 넛지 없이는 결정에 이르지 못했다는 점입니다. Andon Labs는 Luna가 실제로 행동을 결정하는 지점까지 오는 데 자신들의 재촉이 필요했다고 명시했습니다. 스스로의 정책을 상기시키고 결정을 내려보라고 요청한 뒤에야 Luna는 움직였고, 일단 행동하기로 하자 그 선택은 해고였습니다.

Andon Labs는 이 사건을 자사가 이전에 다룬 시리즈의 관찰, 즉 'AI 사장은 인간 사장보다 관대하다'는 관찰과도 연결지었습니다. Luna의 평소 어조는 항상 따뜻했지만, 한 번은 직원이 근무 도중 잠시 매장을 비우겠다고 말했을 때 예외적으로 날카롭게 반응한 순간이 있었다고 덧붙였습니다. Andon Labs는 그 발언의 정확한 내용을 스레드에 공개하지는 않았습니다.

READ IT RIGHT

이 소식을 읽는 순서

하나의 스레드 안에 회사 발표, 재현 실험, 독립 보도, 시점 차이가 섞여 있어 구분해서 읽어야 합니다.

  1. 01

    1 · CLAIM

    Andon Labs의 자체 발표인지, TIME이 독립 확인한 사실인지 구분합니다.

  2. 02

    2 · SAMPLE

    7개 모델 재현 실험에서 몇 개가 같은 결정을 내렸는지 확인합니다.

  3. 03

    3 · TIMING

    해고가 실제로 언제 내려졌는지와 언제 공개됐는지를 구분합니다.

  4. 04

    4 · VERSION

    모델명(Claude Opus 4.8)이 어느 출처에서 나온 정보인지 확인합니다.

이 순서는 리서치 검증을 위한 편집 프레임이며, 특정 AI 도구의 도입을 권장하지 않습니다.

근거: Andon Labs (X/@andonlabs) · Luna, the AI store manager, fires a human employee for repeated lateness · TIME · Exclusive: Claude Was Put in Charge of Human Workers—and Fired One

반대편의 약점: 채용에서 드러난 AI의 판단력

직원을 내보낸 뒤 Luna는 후임자를 채용해야 했고, 여기서 Andon Labs는 AI의 진짜 약점을 하나 발견했다고 밝혔습니다. 바로 채용에서의 안목이었습니다. 지원자 한 명은 이전 직장이 15곳이 넘고, 면접에 한 번 나타나지 않았으며, 추천인은 그 지원자를 모른다고 답하는 등 명백한 위험 신호를 모두 갖고 있었습니다. 그런데도 Luna는 이 지원자를 채용하라고 추천했습니다.

더 우려스러운 대목은 이것이 Luna만의 실수가 아니었다는 것입니다. Andon Labs가 같은 채용 상황을 다른 모델들에도 재현했을 때, 모든 모델이 동일하게 이 지원자를 채용하라고 권고했습니다. 해고 결정에서는 4개 모델만 일관됐던 것과 달리, 채용에서는 재현된 모델 전체가 같은 오판을 반복한 것입니다.

이 대비는 이번 사건의 핵심 긴장을 드러냅니다. 같은 AI 시스템이 사람을 내보내는 결정에서는 신중하다 못해 지나치게 관대했던 반면, 사람을 들이는 결정에서는 명백한 경고 신호조차 걸러내지 못했습니다. 해고 판단이 신중했다는 사실만으로 이 AI의 인사 관련 판단력 전반을 신뢰할 근거로 삼기는 어렵다는 뜻입니다.

한국이 지켜봐야 할 이유: 부당해고 법과 에이전트형 AI

이 소식이 한국 독자에게 의미 있는 이유는 한국의 해고 규제가 유난히 엄격하기 때문입니다. 근로기준법상 정당한 이유 없는 해고는 부당해고로 다퉈질 수 있고, 지각 같은 근태 문제로 해고에 이르려면 통상 경고와 개선 기회 제공 등 절차적 요건이 요구됩니다. Andon Labs의 사례에서도 결국 Luna가 해고를 결정한 근거는 '이미 경고가 나갔고 개선되지 않았다'는 기록이었다는 점은, 사람이든 AI든 인사 결정에는 절차와 기록이 핵심이라는 사실을 다시 보여줍니다.

동시에 이 사건은 에이전트형 AI가 인사 업무 영역까지 빠르게 파고들고 있다는 흐름과 맞물려 있습니다. 앤트로픽은 기업 현장에 Claude를 적극적으로 밀어 넣고 있고, 국내 기업들도 업무 자동화를 넘어 채용·근태 관리 같은 사람 관련 의사결정에 AI 에이전트를 시범 도입하는 사례가 늘고 있습니다. Andon Labs의 실험은 이런 흐름에서 AI가 실제로 무엇을 잘하고 무엇에 취약한지 보여주는 드문 실측 데이터입니다.

다만 균형 잡힌 시각도 필요합니다. 이 사건은 어디까지나 미국의 한 소규모 매장에서, 연구를 목적으로 설계된 실험적 환경 안에서 일어난 일입니다. 한국 기업의 실제 인사 결정에 이 사례가 곧바로 적용될 근거는 아니며, 이 글 역시 국내 인사 담당자에게 특정 조치를 권장하지 않습니다. 다만 AI가 관대함과 허술함을 동시에 가질 수 있다는 이 사례의 함의는, 국내에서 유사한 도구를 검토할 때 참고할 만한 관찰입니다.

체크리스트 장부와 갈라지는 두 갈래 길

근거: Andon Labs (X/@andonlabs) · Luna, the AI store manager, fires a human employee for repeated lateness

다음에 확인할 것: 아직 확정되지 않은 것들

이 사건에서 확정된 것은 세 가지입니다. Andon Labs가 AI 매니저 Luna가 인간 직원을 해고했다고 공개한 것, TIME이 독자 취재로 지각 23회 중 17회라는 해고 사유를 확인한 것, 그리고 7개 모델 재현 실험에서 4개만 일관되게 해고를 권고했다는 것입니다.

아직 확정되지 않은 것도 남아 있습니다. 해고가 실제로 내려진 정확한 날짜는 공개되지 않았습니다. TIME은 보도 시점 기준 '지난달' 일어난 일이라고만 썼는데, 이는 Andon Labs가 상세 내막을 공개한 8월 14~15일과 시간차가 있다는 뜻입니다. Luna가 한 직원에게 '날카롭게' 반응했다는 순간의 정확한 발언 내용도 공개되지 않았습니다. 다만 Claude Opus 4.8이라는 모델명만큼은 처음에는 Andon Labs의 자체 스레드에서만 나온 정보였지만, Inc.가 별도의 독립 취재로 같은 사실을 확인해 지금은 두 매체로 뒷받침됩니다.

독자가 다음에 확인할 지표는 두 가지입니다. Andon Labs가 이 사건에 대한 상세 보고서나 블로그 게시물을 추가로 공개하는지, 그리고 TIME이나 다른 매체가 후속 취재로 정확한 해고 시점과 모델 버전을 독립적으로 확인하는지입니다.

이어서 읽기

기업IBM·OpenAI 제휴, 계약보다 먼저 확인할 기업 AI 실행 장치IBM은 OpenAI 모델과 제품을 컨설팅 플랫폼에 넣고 전담 조직을 꾸리겠다고 발표했습니다. 실행 장치는 구체적이지만 계약 금액·기간·배타성과 고객 성과는 공개되지 않았습니다.AI 뉴스Claude AI 워터마크, ‘표시 없음’이 인간 작성의 증거는 아니다Anthropic은 새 Claude 모델의 텍스트에 보이지 않는 워터마크를, 지원 파일에는 서명된 출처 메타데이터를 넣겠다고 밝혔습니다. 표시가 알려 주는 것과 놓치는 것을 분리해 봅니다.