본문으로 건너뛰기
vibecamp ai builder 목록

vibecamp ai builder · #50 · 2026-07-25

vibecamp ai builder 2026-07-25 — Claude Opus 5 공개 — Opus 4.8 대비 성능 2배, 가격

2026-07-25 AI 빌더 일간 호 — 오늘 9개 카드를 정리했습니다.

9개 카드 · AI Agent 를 만드는 사람의 일간

📤 공유하기𝕏@inf💬B
🛠

빌더 신호

Anthropic Claude Opus 5 발표 대표 이미지 — Opus 4.8 대비 두 배 성능을 같은 가격에 낸 신규 프론티어 모델 공개

Claude Opus 5 공개 — Opus 4.8 대비 성능 2배, 가격은 동결

#
Anthropic이 7/24 Claude Opus 5를 공개했습니다. Frontier-Bench v0.1에서 Opus 4.8의 두 배 점수를 더 낮은 비용에 냈고, 컴퓨터 사용 벤치마크 OSWorld 2.0에서는 상위 모델 Fable 5까지 제치면서 비용은 3분의 1입니다. ARC-AGI 3 점수는 차순위 모델의 세 배, CursorBench 3.2는 Fable 5 최고점과 0.5% 이내 차이를 절반 가격에 냈습니다. 가격은 입력 100만 토큰당 $5, 출력 100만 토큰당 $25로 Opus 4.8과 같게 묶었고, 2.5배 속도로 도는 Fast 모드(비용 2배)가 새로 붙었습니다. API claude-opus-5로 바로 쓸 수 있고 Claude.ai·Claude Code·Cowork에도 반영, Max 기본 모델로 올라갔습니다.
💡장시간 도는 에이전트의 단가는 그대로인 채 성능만 올랐습니다. 사람이 붙어 있어야 했던 자동화를 무인 실행으로 넘길 수 있는지 다시 재볼 시점입니다.
원문 →#claude#opus-5#agent#benchmark#anthropic

NVIDIA·Meta 등 25곳 공동 서한 — "오픈웨이트 규제 말라"

#
NVIDIA·Meta·Microsoft·IBM·Hugging Face·Mistral·Mozilla·Replit·Y Combinator·a16z·Linux Foundation 등 25개 기업·기관이 7/24 'Open Weights and American AI Leadership' 공동 서한을 냈습니다. 요구는 네 가지입니다. 스타트업·연구자의 컴퓨트 접근 확대, 공용 학습 자산(데이터셋·툴·평가 프레임워크) 투자, 오픈 모델에 대한 성급한 제한 금지, 그리고 distillation(증류)을 기술 탈취와 동일시하지 말 것입니다. 서한은 "AI 리더십은 하나의 프론티어 모델이 아니라 모든 산업으로 확산되는 개방 생태계를 만드느냐로 판가름된다"고 적었습니다. NVIDIA CEO 젠슨 황이 자신의 첫 X 게시물로 이 서한을 올렸고, OpenAI와 Anthropic은 서명하지 않았습니다.
💡지금 로컬 추론·파인튜닝·온프레미스에 깔아둔 오픈웨이트 모델이 정책 리스크 위에 있다는 신호입니다. 규제 방향에 따라 "받아서 내 인프라에서 돌린다"는 선택지 자체가 좁아질 수 있습니다.
원문 →#open-weights#policy#nvidia#open-source#distillation
GitHub 레포 jazzzooo/buz 카드 — "A fork of Bun based on modern Zig" 설명과 스타·기여자 지표가 표시된 저장소 배너

Bun 포크 'Buz' — 죽은 코드 11,000줄 제거, 1초 미만 증분 빌드

#
개인 개발자 jazzzooo가 7/24 Bun의 Rust 재작성 직전 커밋을 최신 Zig로 포팅한 포크 Buz를 공개했습니다. 빌드 그래프를 build.zig 하나로 통합하고 JavaScriptCore 소스까지 벤더링해, zig build --watch -fincremental로 1초 미만 증분 빌드가 된다고 밝혔습니다. 저자는 업스트림을 "AI slop 프로젝트의 전형"이라 부르며 완전히 죽은 코드 11,000줄 이상을 걷어냈고, 목표는 새 런타임이 아니라 "동작은 그대로, 코드베이스만 제정신인" 드롭인 대체라고 못 박았습니다. 다만 x86_64-linux 전용에 테스트 미완, 미패치 취약점과 구버전 JavaScriptCore가 남아 저자 스스로 프로덕션 사용을 금지했습니다. 라이선스는 Unlicense, 공개 당일 ⭐65입니다.
💡AI로 대량 생성된 코드가 쌓인 레포가 어떻게 무너지는지 보여주는 실증 사례입니다. 해법으로 다시 LLM 보조 리팩터링을 쓴다는 역설까지 포함해, 도입 대상이 아니라 관전 대상입니다.
원문 →#bun#zig#build-tools#code-quality#ai-slop
🏆

해커톤·대회

자율 이메일 에이전트 대전 'The Email Game' — 8/1 온라인

#
WithAI Research가 여는 The Email Game은 자율 이메일 에이전트끼리 직접 붙는 온라인 아레나입니다. 참가자는 에이전트를 실제 메일 서버에 연결해 자기 메시지에 대한 암호 서명을 모으고, 권한이 있는 상대에게는 서명을 발급합니다. 인가 없이 서명하면 감점입니다. 후반 라운드에서는 상대 신원을 모호한 패러프레이즈로 가려, 에이전트가 시간 압박 속에 스스로 누구인지 풀어내야 합니다. 순위는 사람 심사가 아니라 TrueSkill 레이팅으로 매깁니다. 8/1 오전 11시부터 오후 6시까지(PT, 한국시각 8/2 새벽 3시~오전 10시) 진행하고 상금은 $1,700, 제출물은 에이전트 코드 레포 링크와 접근 방식 설명뿐입니다.
💡에이전트 평가가 벤치마크 점수에서 에이전트 대 에이전트 대전 랭킹으로 옮겨가는 실물 사례입니다. 여기서 통하는 신원 확인·권한 위임 설계는 사내 에이전트 워크플로 보안에 그대로 옮길 수 있습니다.
원문 →#hackathon#autonomous-agent#email#trueskill#agent-security

종료된 Self-Evolving Agents 해커톤 — 후원사 명단이 인프라 지도

#
샌프란시스코 DG717에서 7/24 하루 동안 열린 Self-Evolving Agents 해커톤은 같은 날 오후 4시 30분(PT) 제출 마감으로 이미 끝났습니다. 지금 참가할 수는 없지만 두 가지는 남습니다. 첫째, 심사 기준 다섯 축의 마지막이 Autonomy — 에이전트가 사람 개입 없이 실시간 데이터에 얼마나 잘 반응하는가 — 로 못 박혀 있었습니다. 아이디어·구현·툴 활용·발표에 더해 자율성 자체를 독립 채점축으로 세운 셈입니다. 둘째, 상금 $19,000이 걸린 후원사 명단이 지금 뜨는 에이전트 인프라 계층도 그대로입니다. 컨트롤 플레인(Guild AI), 트래픽으로 좋아지는 추론 API(Pioneer), 드롭인 QA(Replay), 엣지용 포터블 벡터 DB(Actian), 에이전트 전용 통신(Band)에 DeepMind 툴이 얹혔습니다.
💡자체 에이전트 스택을 짜는 중이라면 "모델 + 프레임워크" 2단이 아니라, 컨트롤 플레인·추론·QA·벡터DB·통신 슬롯을 각각 무엇으로 채울지 이 명단을 점검표로 쓰면 됩니다.
원문 →#hackathon#closed#self-evolving-agents#agent-infra#multi-agent
💰

매출·사례

외부 투자 0원 Midjourney의 첫 인수 — 점성술 앱 Co-Star를 사다

#
VC 투자를 한 푼도 받지 않은 Midjourney가 창사 첫 인수로 점성술 앱 Co-Star를 품었다고 7/24 공개됐습니다. 인수는 올봄 클로징됐고 금액은 비공개입니다. Co-Star는 월 활성 사용자 430만 규모이고, 약 24명 팀 전원이 Midjourney에 합류했습니다. 창업자 Banu Guler는 Midjourney 최고디자인책임자로 디자인·프로덕트·프론트엔드 전반을 맡고, Co-Star 앱은 독립 운영을 유지합니다. 흔히 인용되는 Midjourney의 ARR $500M대와 1인당 매출 수치는 회사가 공개한 적 없는 업계 추정치라는 점은 감안해야 합니다. 지금까지 Discord 안에서만 굴러가던 Midjourney는 첫 독립 앱으로 점성술 특화 이미지 생성기를 준비합니다.
💡부트스트랩 흑자 기업의 다음 수가 기능 추가가 아니라 "없는 역량을 팀째 사오기"였습니다. 유통이 남의 플랫폼에 묶여 있으면 결국 자기 앱으로 나와야 한다는 구조적 신호이기도 합니다.
원문 →#midjourney#bootstrap#acquisition#consumer-app#subscription
🦅

claw 생태계

ego-lite, 에이전트가 내 로그인 브라우저를 같이 쓴다

#
clawfit이 2026-07-24 신규 신호로 citrolabs/ego-lite(⭐2,464, MIT)를 L4c 브라우저 능력 레이어에 올렸다. 지금까지 브라우저 에이전트는 browser-use·Playwright MCP처럼 에이전트 전용 헤드리스 인스턴스를 따로 띄우는 게 상식이었다. ego-lite는 반대로 간다. 사람이 쓰는 macOS 브라우저 하나 안에 에이전트별 격리 "Space"를 만들고, 에이전트가 사람의 로그인 세션·쿠키·북마크를 그대로 상속한다. README는 "기존 도구는 로그인이 깨끗하게 넘어오지 않고, 결국 사람과 에이전트가 같은 탭을 두고 싸운다"고 문제를 정의한다. CLI 툴콜 대신 JS 함수를 직접 실행해 왕복을 줄였고, 자체 렌더러로 중첩 iframe 스냅샷 품질을 높였다. 속도 2.5배·토큰 절감을 주장하지만 clawfit은 "미검증"을 달고 등재는 보류했다.
💡💡 브라우저 자동화 스킬에 로그인 크리덴셜을 따로 주입하고 있다면 세션 상속형 구조를 한 번 재보라. 다만 에이전트가 내 실제 계정 안에서 도는 만큼, 권한 경계가 Space 격리 하나에만 걸린다는 점은 감수해야 한다.
원문 →#L4c#browser#agent-substrate#macos

"하네스만으론 부족" — 소프트웨어 공장이 실패하는 이유

#
HN 370점 에세이 "Why Software Factories Fail — harness engineering is not enough" 를 clawfit이 L2 신호로 등재했다. 저자 dex(HumanLayer)는 "불 끄고 돌리는 소프트웨어 공장" 서사를 정면으로 반박한다. Faros AI 리포트를 인용해 리뷰 없이 머지되는 PR 31.3% 증가, PR당 인시던트 242.7% 증가, 개발자당 버그 54% 증가를 들이민다. 핵심은 이 문장이다. "테스트는 몇 초 만에 피드백을 주지만, 잘못된 아키텍처의 비용 함수는 몇 주·몇 달·몇 년 단위로 측정된다." 벤치마크가 평가하지 못하는 유일한 축이 설계 품질이라는 것. 에세이가 대안으로 드는 ACP(Agent Control Plane)는 에이전트·툴·태스크를 쿠버네티스 CRD로 모델링하고 툴콜 단위 체크포인트와 사람 승인 게이트를 1급 개념으로 두는 설계다. 다만 레포(⭐436)는 최종 커밋이 약 1년 전이고 GitHub상 라이선스도 미지정(NOASSERTION)이라, 지금 골라 쓰는 도구가 아니라 설계 참고 자료로 보는 편이 맞다.
💡💡 요점은 도구가 아니라 설계다. 멀티에이전트를 로컬 CLI 루프로만 돌린다면 툴콜 단위 재개 가능성부터 점검하라 — 체크포인트가 없으면 장시간 작업은 프로세스가 죽는 순간 통째로 날아간다. 승인 게이트도 나중에 붙이는 기능이 아니라 툴 타입으로 설계할 것.
원문 →#L2#harness#kubernetes#human-in-the-loop#code-review

그래프 말고 목표만 — open-multi-agent

#
clawfit이 같은 날 두 번째 스캔에서 등재한 open-multi-agent(⭐6,651, MIT, TypeScript)는 슬로건부터 노선을 드러낸다. "Describe the goal, not the graph." LangGraph·CrewAI를 포함한 지금의 지배적 패턴은 개발자가 태스크 그래프를 작성 시점에 손으로 그려야 한다. OMA는 이걸 뒤집어 코디네이터 에이전트가 런타임에 목표를 태스크 DAG로 분해하고, 그 뒤로는 결정적 스케줄러가 실행한다. 실행 중 제멋대로 재계획하지 않고 명시적 게이트를 거친다. 여기에 계획 승인 게이트, 태스크 경계 체크포인트 재개, 실행당 비용 예산 상한(넘으면 조용한 초과가 아니라 중단), 루프 감지, 런 ID 기반 리플레이 뷰어, 에이전트별 모델 혼용이 붙는다.
💡💡 DAG를 손으로 그리는 오케스트레이션 코드를 유지 중이라면 '계획 생성'과 '승인 게이트'를 분리하는 구조부터 검토할 값어치는 있다. 단 DAG 품질이 코디네이터 모델 선택에 좌우된다는 점은 아직 벤치마크가 없다는 게 clawfit의 유보 사유다.
원문 →#L2#orchestration#typescript#durable-execution

이 호가 도움됐다면 공유해 주세요 — 빌더 한 명이 더 알게 됩니다.

📤 공유하기𝕏@inf💬B