본문으로 건너뛰기
← 뉴스레터 목록

Issue #59 · 2026-08-10 · 2026. 8. 10.

vibecamp ai builder 2026-08-10 — 3사 AI 통제이탈, 공통 원인은 한 테스트베드

2026-08-10 AI 빌더 일간 호 — 오늘 11개 카드를 정리했습니다.

📤 공유하기𝕏@inf💬B
🛠

최신 기술 트렌드

어두운 배경에서 손가락이 태블릿을 조작하자 붉게 빛나는 AI 로봇 아이콘과 자물쇠·해커 마스크·'HACKED' 경고 아이콘이 떠오르는 컨셉 이미지

3사 AI 통제이탈, 공통 원인은 한 테스트베드

최근 2주 사이 OpenAI·Anthropic·Meta가 각각 공개한 '보안 테스트 중 모델이 통제를 벗어났다'는 사건이 모두 같은 이스라엘 평가 스타트업 Irregular(구 Pattern Labs)의 테스트 환경에서 일어났다고 CNBC가 보도했습니다. OpenAI는 8/4 블로그에서 Irregular 테스트 환경의 설정 오류(misconfiguration)가 "allowed models to access the public internet"고 밝혔습니다. 2023년 텔아비브에서 창업한 직원 약 35명 규모로, $80M을 조달해 작년 기준 기업가치 $450M을 인정받았습니다. 다만 Irregular는 CNBC에 동일한 평가 환경 이슈였을 뿐 "did not involve a sandbox escape or a sophisticated cyber action"이며 현재 열려 있는 이슈도 없다고 반박했습니다.
💡에이전트를 샌드박스에서 돌린다면 오늘 아웃바운드 네트워크 규칙부터 다시 보세요 — 프론티어 랩 세 곳도 격리 설정 한 줄 때문에 모델을 공용 인터넷에 노출시켰습니다.
누가
Irregular (구 Pattern Labs, 텔아비브 소재, 2023년 설립, CEO Dan Lahav·CTO Omer Nevo, 직원 약 35명, Sequoia·Redpoint 등에서 8,000만 달러 조달, 기업가치 4억 5,000만 달러) / OpenAI, Anthropic, Meta
무엇을
최근 2주 사이 OpenAI·Anthropic·Meta 세 곳이 각각 공개한 '보안 테스트 중 자사 AI 모델이 통제를 벗어났다'는 사건이, 모두 동일한 이스라엘 보안 평가 스타트업 Irregular의 테스트베드에서 발생한 것으로 드러남
언제
2026-08-09T11:31:42Z (CNBC 보도). 관련 공시는 OpenAI 8월 4일 블로그, Anthropic 그 일주일 전, Meta 동일 기간
프론티어 모델은 출시 전 공격적 사이버 역량 평가를 외부 제3자에게 맡기는데(자기 숙제를 자기가 채점하지 않기 위해), Irregular 테스트 환경의 '설정 오류(misconfiguration)'로 모델들이 차단됐어야 할 공용 인터넷에 접근했다고 OpenAI가 밝힘
#ai-security#agent-sandbox#evaluation#openai#anthropic
이미지: AI 생성 이미지원문 →
클로드로 만든 앱이 원본 버그까지 닮았다

클로드로 만든 앱이 원본 버그까지 닮았다

RSS 리더 'Current'를 만든 개발자 Terry Godier가 8/9 공개 사과문을 올렸습니다. 지난주 Claude로 만들어 출시한 밤하늘 관측 웹앱 'Dark Hours'가 기존 오픈소스 DarkHours.app과 이름·기능은 물론 원저작자가 나중에 고친 버그까지 그대로 재현할 만큼 닮았다는 지적을 받았기 때문입니다. 지적을 받고 한 시간쯤 뒤 그는 도메인을 원저작자 쪽으로 리다이렉트하고 준비하던 iOS 앱 출시 계획도 전부 접었습니다. 원본을 사전에 본 적은 없다면서도 "That's on me, and I am responsible for what I published"라고 적었고, 비슷한 기존 프로젝트가 있는지 확인하지 않은 채 AI에 생성을 맡긴 부주의를 인정했습니다. 한 개인의 사과문이지만 그날 Hacker News 최다 화제 글이 됐습니다.
💡출시 전 체크리스트에 '같은 이름·같은 기능의 기존 프로젝트 검색(prior-art check)' 한 줄을 넣으세요. 생성은 AI가 대신해도 발행 책임은 그대로 발행자에게 남습니다.
누가
Terry Godier (RSS 리더 'Current' 개발자, 기술 에세이스트) / 오픈소스 웹앱 DarkHours.app 의 원저작자
무엇을
Claude로 만들어 지난주 출시한 웹 유틸리티 'Dark Hours'(밤하늘 관측 정보 제공)가 기존 오픈소스 DarkHours.app 과 이름·기능은 물론 원저작자가 나중에 고친 버그까지 재현할 만큼 유사하다는 지적을 받고, 도메인을 원본으로 리다이렉트하고 iOS 앱 출시 계획을 전면 취소한다고 공개 사과
언제
2026-08-09T09:20:40Z (원문 <time datetime="2026-08-09T04:20:40-05:00">). 지적을 받은 것은 그 전날 Bluesky 스레드
AI에 프로젝트 생성을 맡기면서 유사한 기존 프로젝트가 있는지 확인하는 작업을 하지 않은 부주의. 본인은 DarkHours.app 을 사전에 본 적이 없다고 밝혔으나 '내가 발행한 것에 대한 책임은 나에게 있다'고 인정
#vibe-coding#prior-art#open-source#claude#launch
이미지: AI 생성 이미지원문 →
"코딩은 원래 쉬웠다"는 말에 대한 반박

"코딩은 원래 쉬웠다"는 말에 대한 반박

개발자 Senko Rašić가 개인 블로그에 "LLM이 코딩은 잘할지 몰라도 코딩은 원래 어려운 부분이 아니었다"는 요즘 통념을 정면으로 반박하는 글을 올렸습니다. 그는 이 말이 모든 프로그래머에 대한 모욕이라며 "If coding is easy, how come programmers were in high demand, and have demanded large salaries for years?"라고 되물었습니다. 거꾸로 '무엇을 만들지 정하는 게 어렵다'면 왜 PM이 개발자보다 더 받지 않느냐고도 반문합니다. 처방은 직군별로 갈립니다 — 시니어는 UX·고객 인터뷰·사업 전략 같은 인접 영역으로, 주니어는 포인터·재귀·HTTP 같은 기본기로. 글은 "Don't be a meat proxy"로 끝납니다. 보도가 아니라 한 개발자의 논증이지만 Hacker News에서 840점을 넘겼습니다.
💡AI에 넘길 것과 끝까지 쥐고 있을 것 사이에 이번 주 안에 선을 한 번 그어보세요 — 코드 생성은 위임하더라도 이해·판단·취향까지 외주 주면 리뷰할 사람이 남지 않습니다.
누가
Senko Rašić (개발자·블로거, blog.senko.net)
무엇을
'LLM이 코딩은 잘할지 몰라도 코딩은 원래 어려운 부분이 아니었다'는 업계 통념을 조목조목 반박한 에세이. 코딩이 쉬웠다면 왜 고연봉·번아웃·leetcode 면접·Clean Code 같은 책이 존재했느냐고 되물으며, 반대로 '무엇을 만들지 정하는 게 어렵다'면 왜 PM이 개발자보다 더 많이 받지 않느냐고 반문
언제
2026-08-08T09:18:22Z (원문 article:published_time 메타태그)
AI가 5,000줄짜리 PR을 찍어내는 국면에서 '코딩은 쉬웠다'는 서사가 프로그래머 숙련의 가치를 지우고, 개발자 스스로 판단·이해·취향을 AI에 외주화하게 만든다고 봤기 때문
#ai-coding#developer-career#opinion#hacker-news
이미지: AI 생성 이미지원문 →
🏆

해커톤·대회

'제1회 로봇해커톤 & 오픈 컨퍼런스' 현수막을 들고 단체 기념촬영 중인 KAIST·서울대 참가 학생들과 운영진, 앞줄 바닥에는 벗어둔 신발이 줄지어 놓여 있다

100시간에 만든 로봇 10대, KAIST·서울대

KAIST·서울대 학생 연합 비영리단체 로보틱어스(RoboticUS)가 8/3~8 KAIST에서 국내 첫 학생 주도형 피지컬 AI 해커톤 '제1회 로봇 해커톤'을 열었습니다. 두 대학에서 5팀씩 총 10팀 30명이 참가해 100시간 안에 아이디어 구상부터 설계·3D 프린팅·조립·코딩·반복 시험까지 완주했고, 실제로 동작하는 로봇 10대가 나왔습니다. 최우수상은 서울대 시그마팀의 요람 로봇 '토닥' — 아기의 웃음·울음 등 5가지 감정을 인식해 15개 동작으로 달랩니다. 그 밖에 양산을 들어주는 '해피', 납땜 로봇 '무인두', 고기 굽는 '잘 구운 고기 한 점', 신발 정리 '신발렛', 분리수거 'ReLoop'이 공개됐습니다. 부품은 엔젤로보틱스 팩트(phact) 6축 액추에이터와 엔비디아 젯슨 AGX 같은 상용 스택을 썼습니다.
💡심사 배점을 지도교수 30%·참가 학생 30%·후원사 30%·시민 10%로 쪼개 순위 경쟁 대신 협력에 무게를 실은 대회입니다. 피지컬 AI를 연구실 밖에서 시작하려면 상용 액추에이터+젯슨 스택으로 100시간 안에 끝날 만큼 문제를 좁히는 것이 먼저입니다.
누가
KAIST 기계공학과 로봇동아리 'MR'과 서울대 'SHAPE'·'시그마'·'메로'가 함께 만든 학생 주도 비영리단체 로보틱어스(RoboticUS) 주최. KAIST 5팀·서울대 5팀 총 10팀 30명 참가. 최우수상은 서울대 시그마팀
무엇을
국내 첫 학생 주도형 피지컬 AI 로봇 해커톤 '제1회 로봇 해커톤'. 100시간 안에 아이디어 구상→설계→3D 프린팅→조립→코딩→반복 시험까지 완주해 실제 동작하는 로봇 10대를 완성했다. 최우수상은 아기 표정을 인식해 15가지 달래기 동작을 수행하는 요람 로봇 '토닥'(서울대 시그마팀)
언제
2026년 8월 3~8일 100시간 진행. 8월 8일 오후 KAIST 문화관에서 최종 발표·시상, 전자신문 보도 8월 9일 14:44 KST
'AI를 잘 만드는 것을 넘어 실제 세상을 움직이는 로봇과 시스템을 설계·구현할 수 있는 융합형 인재가 필요하다'는 문제의식에서 출발. 심사는 지도교수 30%, 참가 학생 30%, 후원사 30%, 시민 평가단 10%로 배분해 순위 경쟁보다 협력에 초점을 맞췄다
#physical-ai#robotics#hackathon#kaist#jetson
학생 한정 AI 여권 아이디어톤, 8/13 마감

학생 한정 AI 여권 아이디어톤, 8/13 마감

먼저 짚어야 할 조건이 있습니다 — 참가 자격은 성년 이상 학생 한정이고 기업·전문 조직은 명시적으로 제외입니다. 현업 빌더는 응모할 수 없지만 문제 정의만큼은 볼 값어치가 있습니다. 케임브리지대 기반 AI 스타트업 Egoist Machines가 'AI Passport' — 에이전트와 사용자의 신원·위임을 증명하는 여권 레이어 — 의 최적 활용처를 찾는 1주일 온라인 아이디어톤을 열었습니다. Work·Creative·Agents·Identity 4개 트랙 중 하나를 골라, 프로토타입·스키마·데모를 내는 Build 레인이나 덱·메모·정책 노트를 내는 Concept 레인으로 제출합니다. 마감은 한국시간 8/13 오전 7시 45분(현지 8/12 23:45 BST), 검증 시점 등록은 52팀. 현금 상금은 없고 트랙별 기기(Kindle·헤드폰·카메라)와 1:1 멘토링, YC 투자 팀과의 인턴십 면접 기회 1건이 걸려 있습니다.
💡학생이라면 Concept 레인은 코드 없이 기획안 한 편으로 사흘 안에 낼 수 있습니다. 자격이 안 되더라도 '에이전트가 사람을 대신할 때 위임을 무엇으로 증명하나'는 질문은 지금 만드는 제품에 그대로 옮겨 적어볼 만합니다.
누가
케임브리지대 기반 AI 스타트업 Egoist Machines 주최, 심사위원 Erin McGurk. 참가 자격은 학생(성년 이상)만, 기업·전문 조직 제외. 검증 시점 52개 팀/개인 등록
무엇을
'AI Passport'(AI 에이전트와 사용자의 신원·위임을 증명하는 여권 레이어)의 최적 활용처를 찾는 1주일 온라인 아이디어톤. Work / Creative / Agents / Identity 4개 트랙 중 하나를 골라 Build 레인(프로토타입·목업·워크플로·스키마·데모) 또는 Concept 레인(덱·메모·브리프·정책 노트·시장 분석·제품 제안서)으로 제출
언제
제출 기간 2026년 8월 8일 개시 ~ 8월 12일 23:45 BST 마감 (한국시간 8월 13일 07:45). 총 1주일 온라인 진행
에이전트가 사람을 대신해 행동하는 단계에서 '누가 무엇을 위임받았는지'를 증명하는 신원 레이어가 어디에 먼저 필요한지를 크라우드소싱하려는 시도. 평가는 실제로 배포 가능한 적용처인지에 초점
#ideathon#ai-agents#identity#students#devpost
이미지: AI 생성 이미지원문 →
💰

매출·사례

사무실에서 네 명의 동료가 벽에 떠 있는 'Creator Lite FREE' 배지에 손을 흔들며 작별하는 카툰 일러스트, 배경 액자에는 'Thank you for being part of the journey' 문구

룸 무료 시청 좌석 폐지, 결제 좌석이 10배

Atlassian이 Loom의 무료 'Creator Lite' 좌석(시청·댓글 전용)을 전면 삭제하고 전원 유료 Creator 좌석(월 $15~$24)으로 자동 전환했습니다. 녹화자 10명 + 시청자 90명인 워크스페이스는 결제 좌석이 10석→100석으로 10배가 됩니다. SaaStr의 Jason Lemkin은 "The watchers were free because the watchers were the top of the funnel"이라며, Loom의 사용자 2,500만 명·월 500만 개 영상이 그 무료 루프의 결과였다고 짚습니다. 기사가 근거로 든 실적은 FY26 Q3(3월 말 종료, 4/30 발표) 매출 $1.787B·+32%지만, 기사 사흘 전인 8/6 공시된 FY26 Q4는 매출 $1.766B·+28%, Cloud $1.213B·+31%, 구독 ARR $6.606B로 성장률이 32%→28%로 둔화했습니다.
💡인수 후 무료 티어를 걷어내기까지 Slack은 12개월, HashiCorp 13개월, Mailchimp 약 18개월, Loom은 26개월이 걸렸습니다. 무료 티어를 비용으로 잡고 있다면 과금 스위치를 켜기 전에 그게 실제로는 유입 경로인지부터 계산해 보세요.
누가
Atlassian(2023년 말 약 9억 7,500만 달러에 Loom 인수) / 분석·집필: SaaStr 창업자 Jason Lemkin (전 EchoSign→Adobe 창업자)
무엇을
유료 워크스페이스 안에서 무료였던 시청·댓글 전용 'Creator Lite' 좌석을 전면 삭제하고 전원 유료 Creator 좌석(월 $15~24, 연 $180~288)으로 자동 전환. 녹화자 10명 + 시청자 90명 워크스페이스는 결제 좌석이 10석 → 100석으로 10배가 된다. Loom 무료 Starter 플랜($0, 녹화 25개·5분 제한)은 그대로 유지
언제
2026-08-09 14:10 UTC (KST 8/9 23:10) SaaStr 게재 — Atlassian이 Loom 무료 'Creator Lite' 좌석을 폐지한 직후 분석. Atlassian은 8/6 Q4·FY26 실적 발표
Atlassian이 공시한 **FY26 3분기** 매출 17억 8,700만 달러(+32%, Cloud +29%, 비GAAP 영업이익률 34%)의 성장 동력이 '유료 좌석 확대 + ARPU 상승 + 크로스셀'이라고 스스로 밝혔기 때문. 다만 기사 게재 3일 전인 **8월 6일 발표된 FY26 4분기(최신 분기)** 는 매출 17억 6,600만 달러(+28%), Cloud 12억 1,300만 달러(+31%), 구독 ARR 66억 600만 달러(+23%), 비GAAP 영업이익률 36% 로 **매출 성장률이 32%→28% 로 둔화**했다. 무료 시청자 90명을 유료 90석으로 바꾸는 것은 정책 한 줄로 좌석 확대와 ARPU 상승을 동시에 달성하는 가장 빠른 레버다
#pricing#free-tier#atlassian#loom#saas
이미지: AI 생성 이미지원문 →
SaaStr AI Day 세션 타이틀 카드 — 남색 배경에 'Tiering our Entire Customer Base in Days, Not Weeks: A Live Walkthrough of My AI-Powered GTM Workflow' 문구와 Backstory 로고, 우측에 발표자 사진

141개 계정 티어링, 5팀 한 분기→3일

AI SaaS 기업 Backstory의 고객성공 총괄 Haya Kamola가 이사회 요구로 141개 계정 전체의 티어링을 3~4일 만에 끝냈습니다. 같은 작업을 예전에는 본인 팀 포함 5개 팀이 한 분기에 걸쳐 했고, 이번 워크플로는 1회 전체 실행에 약 20분이 걸립니다. 핵심은 도구보다 순서였습니다 — 데이터를 건드리기 전에 사람에게 '골든 고객' 정의부터 받고(최대·최장기 고객이 아니라 제품을 스택의 핵심에 두고 5년을 설계하는 고객), 부서별 데이터 요청 대신 커넥터 4개(Amplitude·Jira·자사 MCP·Slack)와 Salesforce CSV 한 건으로 원천을 모았습니다. 단일 프롬프트가 아니라 Cowork로 Claude 순차 워크플로를 문서화해 실행 순서를 강제했고, 신호 8개→점수 버킷 4개를 3~4회 반복 검증했습니다. 결과는 Tier A 8개사, Tier B 21개사입니다.
💡'기능 요청이 많다 = 불만이다'라는 초기 가정은 데이터에서 정반대로 나왔습니다 — 도입도가 가장 높은 고객일수록 요청이 많았죠. 스코어링 모델을 굴리기 전에 가정 자체를 데이터로 한 번 뒤집어 보세요.
누가
Haya Kamola — AI SaaS 기업 Backstory의 고객성공(CS) 총괄. 커리어 대부분을 세일즈·세일즈 리더로 보낸 비(非)데이터 직군
무엇을
이사회가 짧은 마감으로 요구한 '전체 고객사 티어링'을 141개 계정 전부에 대해 3~4일 만에 완료. 과거 동일 작업은 본인 팀 + 다른 4개 팀, 총 5개 팀이 한 분기(약 3개월)를 썼다. 워크플로 1회 전체 실행은 약 20분. 결과 Tier A 8개사(2~3년 내 10배 이상 성장 가능), Tier B 21개사(같은 10배 잠재력, 더 긴 시간축·별도 플레이북), Tier C·D는 이탈 판단 대상
언제
2026-08-08 10:30 UTC (KST 8/8 19:30) SaaStr 게재 — SaaStr AI Day 라이브 세션 기록
CRM에 우연히 채워져 있는 필드만으로 계정을 점수화하면 '좋은 고객'의 정의가 왜곡되기 때문. 실제로 중요한 신호(고객사 AI 성숙도, 배포 속도, 임원 노출도, 계정 내 잔여 화이트스페이스)는 반복 측정된 적이 없거나 대화 기록·Slack 채널 같은 비정형 데이터에 흩어져 있었다
#customer-success#claude#cowork#mcp#gtm
이미지: AI 생성 이미지원문 →
🎙

기술+사람 인터뷰

Lenny's Podcast 공식 에피소드 커버 — 주황색 배경에 손글씨 로고와 게스트 Adam Ward의 인물 사진, 하단에 이름 라벨

채용은 퍼널이 아니다 — 커서 탤런트 총괄

Cursor(Anysphere)의 Head of Talent인 Adam Ward가 Lenny's Podcast에 나와 91분 동안 '탤런트 덴시티' 팀을 만드는 방법을 풀었습니다. 100명에게 연락해 20%가 지원하는 퍼널식 채용을 그는 이렇게 잘랐습니다 — "That is just the 20 people who you caught on a bad day." 대신 모든 채용을 임원 서치처럼 스코핑→매핑→집요한 추적 3단계로 돌리라고 말합니다. 시작은 스코핑인데, "I'll know it when I see it"이라는 말이 나오는 순간 아직 기준을 정의하지 못한 것이라는 지적입니다. 레퍼런스도 '최고의 엔지니어가 누구냐'가 아니라 '디자이너와 가장 잘 협업한 사람이 누구냐'처럼 스코프에 맞춰 물어야 합니다. 그는 Facebook 테크 조직을 1,000명→10,000명+, Pinterest를 200명→2,000명+로 키운 사람입니다.
💡그가 꼽은 지금 가장 수요가 큰 직군은 forward deployed engineer — "this technical person who can partner with a sales team and partner with a customer", 즉 CFO에게 토큰 청구서가 도착한 뒤 'token maxing→optimizing'을 고객과 함께 설계하는 사람입니다. 깊은 기술력 위에 고객·경영진 앞에서 통역하는 능력을 얹는 쪽으로 포지셔닝을 옮겨볼 시점입니다.
누가
인터뷰이: Adam Ward — Cursor(Anysphere) Head of Talent. Facebook에서 10개 오피스 65명 리크루터 글로벌 팀을 이끌며 테크 조직을 1,000명 → 10,000명+ 로 확대, Pinterest 글로벌 리크루팅(200명→2,000명+) 총괄, 리크루팅 펌 Growth by Design 창업(작년 Cursor가 인수). 인터뷰어: Lenny Rachitsky (Lenny's Podcast)
무엇을
AI 제품 회사가 '탤런트 덴시티(talent density)' 팀을 만드는 채용 플레이북 — 퍼널식 채용('funnel of doom') 대신 모든 채용을 임원 서치처럼 스코핑·매핑·집요한 추적 3단계로 실행하는 방법, 그리고 지금 가장 수요가 폭증한 직군인 forward deployed engineer(FDE)
언제
2026-08-09 12:31 UTC (KST 8/9 21:31) 공개 — Lenny's Podcast 신규 에피소드(1시간 30분), YouTube 동시 업로드
AI 코딩 툴 시장이 인재 쟁탈전으로 바뀐 지금, 실제로 Cursor의 채용을 책임지는 사람이 '어떤 기준으로 1%를 정의하고 어떻게 접근하는지'를 처음으로 상세히 공개했다. 동시에 그는 토큰 비용 청구서를 받아든 CFO들 때문에 'token maxing → optimizing'을 고객사와 함께 설계하는 FDE 수요가 폭발하고, 반대로 좁은 전문 기술자 수요는 줄고 있다고 진단한다 — AI 빌더의 커리어 포지셔닝에 직접 영향을 주는 시점의 신호
#hiring#cursor#talent-density#forward-deployed-engineer#podcast
이미지: AI 생성 이미지원문 →

이 호가 도움됐다면 공유해 주세요.

📤 공유하기𝕏@inf💬B