본문으로 건너뛰기
← 뉴스레터 목록

Issue #57 · 2026-08-07 · 2026. 8. 7.

vibecamp ai builder 2026-08-07 — ChatGPT 유료는 Sol 하나로, 무료는 무제한

2026-08-07 AI 빌더 일간 호 — 오늘 11개 카드를 정리했습니다.

📤 공유하기𝕏@inf💬B
🛠

최신 기술 트렌드

ChatGPT 유료는 Sol 하나로, 무료는 무제한

ChatGPT 유료는 Sol 하나로, 무료는 무제한

OpenAI가 8/6 ChatGPT의 GPT-5.6 Sol을 손봤다. Plus·Pro에서는 즉답과 심층 추론을 Sol 하나가 모두 맡고, 응답 깊이를 사용자가 직접 조절하는 effort 슬라이더가 붙는다. 내부 평가에서는 금융·의료·법률 프롬프트 기준 "사실 오류가 하나 이상 들어간 응답이 GPT-5.5 Instant 대비 Sol은 약 68%, Luna는 약 62% 줄었다"고 밝혔다. 무료·Go 사용자에게는 다음 주부터 더 저렴한 GPT-5.6 Luna 무제한 텍스트 대화와 'Think' 버튼이 열린다. 다만 파일 업로드·이미지 생성 같은 도구 제한은 그대로여서, 같은 발표를 '무료 티어를 가장 가벼운 모델에 묶어두는 조치'로 읽는 시각도 함께 나온다.
💡모델 이름으로 분기하던 라우팅 로직을 걷어내고 effort 값 하나로 품질과 비용을 조절하는 구조로 옮겨볼 시점입니다. 무료 대화가 무제한이 된 만큼, 소비자용 제품에서 '대화 횟수'로 과금하던 설계는 다시 계산해봐야 합니다.
누가
OpenAI (ChatGPT 제품팀)
무엇을
ChatGPT의 GPT-5.6 Sol을 개선해 Plus·Pro의 Instant 응답과 심층 추론 양쪽을 모두 Sol이 담당하게 하고, 응답 깊이를 사용자가 조절하는 effort 슬라이더를 추가. 동시에 무료·Go 사용자에게 GPT-5.6 Luna 무제한 텍스트 대화와 'Think' 버튼을 다음 주부터 개방
언제
2026-08-06T17:00:00Z (OpenAI 공식 블로그 및 @OpenAI X 계정 동시 공지, HN 등록 17:02Z)
Instant 응답과 추론 응답 사이의 품질 편차와 사실 오류가 계속 문제였고, 주간 10억 명 규모 사용자에게 모델 선택 부담 없이 일관된 품질을 주려면 하나의 모델이 두 모드를 모두 커버해야 했기 때문
#openai#chatgpt#llm#pricing
이미지: AI 생성 이미지원문 →
스마트폰 화면에 딥시크(DeepSeek) 고래 로고가 떠 있고 뒤편 스크린에 'Artificial intelligence (AI)' 문구가 보이는 사진 — DeepSeek의 API 가격 대폭 인상 예고를 상징한다

DeepSeek, API 가격 '대폭' 인상 예고

DeepSeek이 8/6 오픈플랫폼 공지로 API 가격을 대폭 인상하겠다고 예고했다. 공지는 "머지않아 API 서비스 가격을 대폭 인상할 계획"이라며 "구체적인 가격 조정안은 공식 발표를 따르되, 이용자는 그에 맞춰 사용량 계획을 조정하라"고만 안내했다. 인상폭도 시행일도 공개하지 않았다. 항저우 소재 이 회사는 초저가 정책으로 개발자·기업 수요가 몰리면서 요청량이 플랫폼 용량을 넘어섰고, 잦은 불안정과 컴퓨트 비용 부담이 겹친 상태다. 인상 전 기준으로 DeepSeek-V4-Flash는 100만 입력 토큰 $0.14 / 출력 $0.28. 이 단가를 상수로 놓고 원가를 짠 제품은 지금 숫자를 다시 맞춰야 한다.
💡'중국발 초저가 API'를 고정값으로 전제한 단가표는 이번 주에 다시 열어봐야 합니다. 추론 호출부를 provider 추상화 뒤로 빼두면, 가격이 바뀌었을 때 코드가 아니라 설정만 고치고 넘어갈 수 있습니다.
누가
DeepSeek (항저우 소재, DeepSeek Open Platform)
무엇을
DeepSeek이 오픈플랫폼 공지를 통해 API 서비스 가격을 조만간 '대폭' 인상하겠다고 예고. 인상폭과 적용 시점은 공개하지 않고 사용자에게 사용량 계획을 미리 조정하라고 안내
언제
2026-08-06T05:01:00Z (SCMP 보도 시각 13:01 HKT / DeepSeek 오픈플랫폼 공지 당일)
초저가 정책으로 개발자·기업 사용자가 급증하면서 요청량이 플랫폼 용량을 넘어섰고, 잦은 불안정과 컴퓨트 비용 부담이 겹쳐 자원 압박과 서비스 품질을 맞추려면 가격 조정이 불가피하다는 판단
#deepseek#api#pricing#llm
이미지: AI 생성 이미지원문 →
Artificial Analysis Intelligence Index 막대그래프와 지능-비용 산점도 — Qwen3.8 Max가 56점으로 Claude Opus 4.8과 동률에 오른 재측정 결과를 보여준다

Qwen3.8 Max 56점, 대신 턴 수가 4.5배

Artificial Analysis가 알리바바 Qwen3.8 Max를 재측정해 Intelligence Index 점수를 53→56으로 올렸다. 원문은 이 점수가 "Qwen3.8 Max를 Claude Opus 4.8(max)과 동률에 올려놓고, 구글·메타·xAI의 모든 모델보다 앞세운다"고 적었다. 다만 지수 상단에는 여전히 Anthropic·OpenAI와 Moonshot Kimi K3가 있어 전체 1위는 아니다. 더 중요한 건 점수를 낸 방식이다 — 에이전틱 평가 GDPval-AA에서 평균 64턴을 돌았고, 이전 세대 Qwen3.7 Max의 14턴 대비 4.5배다. 입력 토큰 사용량은 약 15배 늘었고 태스크당 비용도 $0.53→$1.14로 두 배 넘게 뛰었다.
💡에이전트 벤치마크는 점수만 보면 절반만 읽은 셈입니다. 모델을 교체할 때 같은 태스크의 턴 수·입력 토큰·건당 비용을 함께 로깅해두면, 점수 상승이 곧 청구서 상승인지를 그 자리에서 판단할 수 있습니다.
누가
Alibaba Qwen 팀 (모델), Artificial Analysis (벤치마크 집계 기관)
무엇을
Qwen3.8 Max가 Artificial Analysis Intelligence Index에서 재측정 끝에 53 → 56으로 상승하며 agentic index 기준 전체 1위권에 진입. Claude Opus 4.8(max)과 동률이고 Google·Meta·xAI의 모든 모델보다 앞섰다
언제
2026-08-06 (Artificial Analysis 재측정 결과 공개일. 매체 보도는 날짜만 표기, 시각 미표기. HN 등록 2026-08-06T18:44Z)
Qwen3.8 Max가 에이전틱 태스크에서 훨씬 더 많은 턴을 돌며 문제를 푸는 방향으로 설계됐기 때문 — GDPval-AA 기준 평균 64턴으로 Qwen3.7 Max의 14턴 대비 4.5배, 입력 토큰 사용량은 약 15배 늘었다
#qwen#benchmark#agent#cost
이미지: AI 생성 이미지원문 →
🏆

해커톤·대회

디지털 위장복을 입은 미 해병대원이 노트북으로 AI 도구 화면을 들여다보는 뒷모습 — 미 해병대가 훈련·교육용 AI 프로토타입 해커톤을 여는 소식을 나타낸다

미 해병대 AI 해커톤, 상금 대신 실전 배치

미 해병대 대학(MCU)과 해군대학원(NPS)이 훈련·교육용 AI 프로토타입을 만드는 해커톤을 연다. 신청 마감은 8/14, 본행사는 9/15~18 — 첫날은 온라인, 이후 버지니아와 캘리포니아 두 곳에서 나눠 진행한다. 해병대원뿐 아니라 타군·군무원·민간 벤더·학계까지 계급 제한 없이 참가할 수 있고, 역할은 프로토타입을 짜는 '해커', 유스케이스를 정의하는 주제 전문가, 운영 지원 셋으로 나뉜다. 제시된 유스케이스는 맞춤 학습, 시뮬레이션 훈련, 역량 평가, 커리큘럼 콘텐츠 생성, 적시 학습, 행정·데이터 분석, 워게이밍이다. 상금은 현금이 아닌 비금전 시상이지만, Capt. Colton Martine은 "모든 제출물은 심사 기준에 따라 평가되고 사후분석 보고서에 반영돼, 임무 요구를 안전하게 대규모로 충족할 수 있는지를 가늠하는 근거가 된다"고 했다.
💡사내 교육이나 온보딩을 AI로 다시 짤 계획이라면 저 유스케이스 일곱 개를 그대로 체크리스트로 옮겨 쓰면 됩니다. 상금 없이 '우승작을 실제 도입 후보로 올린다'는 설계도 사내 해커톤 기획에 그대로 이식할 만합니다.
누가
미 해병대 대학(MCU)과 해군대학원(NPS)이 공동 주최. 참가 자격은 해병대원뿐 아니라 타군, 군무원, 벤더(민간 기업), 학계까지 개방되며 계급 제한 없음. 역할은 (1) 프로토타입을 직접 만드는 '해커'(AI/ML·데이터사이언스·데이터엔지니어링·소프트웨어 개발 경력 우대), (2) 유스케이스를 정의하는 주제 전문가(SME), (3) 운영·행정 지원 3종으로 나뉜다.
무엇을
군사 훈련·교육 영역에 쓸 AI/ML 프로토타입을 4일 만에 만드는 해커톤. 제시된 '작전상 유의미한 유스케이스'는 개인 맞춤 학습, 시뮬레이션·가상훈련, 역량 평가, 훈련 시나리오·커리큘럼 콘텐츠 생성, 적시(just-in-time) 학습과 작전 지원, 행정 업무와 데이터 분석, 워게이밍이다. 상금은 현금이 아니라 비금전 시상이며, 모든 출품작은 심사 기준에 따라 평가된 뒤 사후분석 보고서에 반영돼 '안전하게, 대규모로 실전 배치 가능한지'를 판단하는 근거가 된다.
언제
신청 마감 2026-08-14 / 본행사 2026-09-15~18 (첫날은 NPS 주관 온라인, 이후 버지니아 MCU + 캘리포니아 NPS 양쪽 오프라인) / 심사 루브릭은 9월 초 해커톤 포털 오픈 시 공개
해병대는 '현대 군사 훈련과 교육은 급변하는 전쟁의 성격에 맞춰 진화해야 하며, AI/ML 같은 첨단 기술 통합은 지금 당장의 전투·교육 과제'라는 입장이다. 올해 4월 콴티코에서 열린 첫 에이전틱·생성형 AI 워크숍에서 '훈련 부족과 신뢰 부족'이 병목으로 지목됐고, 5월에는 전 장병 대상 'Basic AI' 교육을 의무화했다. 이번 해커톤은 그 흐름에서 교육·훈련 도메인의 실물 프로토타입을 확보하려는 후속 조치다.
#hackathon#govtech#edtech#prototype
RSNA 무릎 이상 검출 AI 챌린지의 Kaggle 대회 카드 — 대회명과 상금 $77,000, 무릎 MRI 영상이 함께 표시돼 있다

무릎 MRI 멀티모달 대회, 상금 $77,000

북미영상의학회(RSNA)의 2026 무릎 이상 검출 AI 챌린지가 열린다고 의료영상 매체들이 8/6 보도했다. Kaggle에서 호스팅하며 참가 자격 제한이 없고, 제출 마감은 10/22, 우승자는 11월에 발표해 시카고 RSNA 총회(11/29~12/3)에서 시상한다. 과제는 무릎 MRI에서 인대·반월판 손상, 연골 소실, 골수 병변, 관절 삼출, 활막염, 베이커 낭종을 검출·분류하는 것. 학습 데이터는 5대륙 16개 기관에서 모은 5,000건 이상의 무릎 MRI와 대응하는 다국어 판독문이라, 이미지와 자유서술 텍스트를 함께 다루는 멀티모달 과제다. 상금 $77,000을 상위 팀이 나눠 갖고, RSNA 챌린지 사상 처음으로 "가장 효율적인 모델"에 주는 상이 신설됐다.
💡리더보드 최고점만 쫓던 대회가 추론 효율에 따로 상을 걸기 시작했습니다. 모델 성능표를 만들 때 정확도 옆에 추론 시간과 건당 비용 칸을 지금 추가해두세요.
누가
북미영상의학회(RSNA)가 주최하고 Kaggle에서 호스팅. 전 세계 연구자 누구나 참가 가능(개방형). 평가용 데이터셋은 전문 영상의학과 의사들이 직접 어노테이션했다.
무엇을
무릎 MRI에서 이상 소견(인대·반월판 손상, 연골 소실, 골수 병변, 관절 삼출, 활막염, 베이커 낭종 등)을 검출·분류하는 머신러닝 모델을 만드는 대회. 학습 데이터는 5대륙 16개 기관에서 모은 5,000건 이상의 무릎 MRI 검사와 그에 대응하는 12개 언어 판독문(radiology report)이다. 상금 $77,000을 상위 팀들이 나눠 갖고, 여기에 '가장 효율적인 모델'에 주는 상이 처음으로 포함된다.
언제
2026-08-06 공식 개시 발표 / 제출 마감 2026-10-22 / 우승자 발표 11월 / 시상·전시는 RSNA 2026 연례총회(2026-11-29~12-03, 시카고)
RSNA AI 챌린지 중 근골격계(MSK) MRI를 다루는 첫 대회이자, 의료 영상과 다국어 판독문 텍스트를 함께 학습·평가에 쓰는 첫 대회다. 즉 '이미지만 보는 모델'이 아니라 이미지 + 자유서술 텍스트를 함께 다루는 멀티모달 능력을 직접 겨루게 설계했다. 무릎 MRI는 관절 내부 손상 진단의 표준 검사라 임상적 파급이 크다.
#kaggle#multimodal#medical-ai#competition
💰

매출·사례

엣지 인프라가 AI 순풍을 탔다 — 매출 $696.1M

엣지 인프라가 AI 순풍을 탔다 — 매출 $696.1M

클라우드플레어의 2026년 2분기 매출이 $696.1M, 전년 대비 36% 성장으로 나왔다. 자체 가이던스($664~665M)와 컨센서스($665M)를 모두 넘겼고 non-GAAP 순이익 $107.8M(주당 $0.29), GAAP 총이익률 71.8%, 잉여현금흐름 $56.4M을 기록했다. FY2026 매출 가이던스도 $2.805~2.813B → $2.864~2.870B로 올렸고 발표 직후 주가는 약 15% 뛰었다. 성장을 밀어올린 건 AI 에이전트와 크롤러가 만들어내는 트래픽이다. CEO Matthew Prince는 AI를 "창사 이래 최대 순풍"으로 표현했다. 모델을 직접 만들지 않고도 AI가 반드시 지나가는 길목에 과금 지점을 세운 회사가, 분기 실적으로 답을 받은 셈이다.
💡AI 모델을 만들지 않아도 에이전트 트래픽이 지나갈 수밖에 없는 길목에 계측과 과금을 붙이면 그게 매출이 됩니다. 내 제품이 이미 쥐고 있는 '길목'이 무엇인지부터 한 줄로 적어보세요.
누가
Cloudflare(NYSE: NET), CEO Matthew Prince — 개발자 인프라/엣지 플랫폼 상장사
무엇을
Q2 2026 매출 $696.1M, 전년 동기 대비 +36% 성장. 자체 가이던스($664~665M)와 컨센서스($665M)를 모두 상회. non-GAAP 순이익 $107.8M(주당 $0.29), GAAP 총이익률 71.8%·non-GAAP 73.1%, 잉여현금흐름 $56.4M. Q3 2026 가이던스 $736.0~737.0M, FY2026 가이던스를 기존 $2.805~2.813B에서 $2.864~2.870B로 상향. 발표 직후 주가 약 +14.9%
언제
2026-08-06 16:15 ET(= 2026-08-07 05:15 KST) 미 증시 마감 후 Cloudflare 공식 실적 발표
AI 에이전트·크롤러 트래픽이 폭증하면서 엣지 네트워크가 'AI 시대의 통행료 게이트'가 됐기 때문. Prince는 AI를 창사 이래 최대 순풍(biggest tailwind in history)으로 규정했고, 같은 날 오전에는 AI 어시스턴트가 자사 브랜드를 얼마나 인용·추천하는지 측정하는 AEO Visibility Dashboard(Citation Rate·Mention Rate·Prominence·Share of Voice)를 조기 액세스로 공개하며 AI 트래픽 자체를 신규 유료 상품군으로 전환 중
#cloudflare#earnings#infrastructure#monetization
이미지: AI 생성 이미지원문 →
음성 에이전트가 키운 순확장률 116%

음성 에이전트가 키운 순확장률 116%

트윌리오가 2026년 2분기 매출 $1.50B(보고 기준 22% 증가, 유기적 17%)를 발표하며 컨센서스($1.43B·EPS $1.32)를 넘겼다. 정작 눈여겨볼 숫자는 매출이 아니라 달러 기준 순확장률(DBNER) 108%→116%다. 신규 고객을 늘리지 않아도 기존 고객이 작년보다 더 많이 쓴다는 뜻이다. non-GAAP 영업이익은 $284.6M, non-GAAP 희석 주당순이익 $1.47(GAAP $6.68에는 일회성 세제 혜택 $5.91 포함)이고 FY2026 가이던스도 상향했다. 배경은 기업 상담이 AI 음성 에이전트로 옮겨가며 통화·메시지 발신량 자체가 늘어난 것. Khozema Shipchandler는 "사람과 AI 에이전트가 점점 나란히 일하는 세상에서, 트윌리오는 그 둘 모두를 굴리는 인프라를 제공한다"고 밝혔다.
💡AI 채택률이 그대로 매출 곡선이 되게 하려면 좌석(seat) 과금보다 호출량 과금이 유리합니다. 지금 요금제가 '사람 수'에 묶여 있다면, 에이전트가 사람 대신 일할 때 매출이 늘어나는지 줄어드는지부터 계산해보세요.
누가
Twilio(NYSE: TWLO), CEO Khozema Shipchandler — 커뮤니케이션 API(문자·음성) 플랫폼 상장사
무엇을
Q2 2026 매출 $1.50B, 보고 기준 +22% YoY / 유기적 성장 +17%. GAAP 영업이익 $84.5M, non-GAAP 영업이익 $284.6M, non-GAAP 희석주당순이익 $1.47(GAAP $6.68에는 $5.91의 일회성 세제 혜택 포함). 달러 기준 순확장률(DBNER) 116%로 전년 동기 108%에서 8%p 상승. FY2026 가이던스 상향 — 보고 기준 매출 성장 18~18.5%, 유기적 13~13.5%, non-GAAP 영업이익 $1.135~1.155B, 잉여현금흐름 $1.135~1.155B. 컨센서스(매출 $1.43B·EPS $1.32) 상회
언제
2026-08-06 미 증시 마감 후(= 2026-08-07 새벽 KST) Twilio 공식 IR 보도자료 게시
기업들이 고객 상담을 AI 음성 에이전트로 전환하면서 통화·메시지 발신량 자체가 늘고 있기 때문. Shipchandler는 '사람과 AI 에이전트가 함께 일하는 두 축 모두에 Twilio가 인프라를 제공한다'고 밝혔고, 회사는 AI 에이전트·사람 상담원·멀티채널을 하나의 흐름으로 묶는 Conversation Orchestrator를 밀고 있다
#twilio#earnings#voice-agent#usage-based
이미지: AI 생성 이미지원문 →
🎙

기술+사람 인터뷰

오픈웨이트를 고르는 기준은 단가가 아니다

오픈웨이트를 고르는 기준은 단가가 아니다

a16z 팟캐스트가 vLLM 리드 메인테이너이자 Inferact 공동창업자·CEO인 Simon Mo를 불러 오픈소스 추론 엔진을 다뤘다. 5년 뒤 오픈소스가 프런티어와의 격차를 좁혔겠냐는 질문에 그는 "Capability wise, I don't really see a big gap. Not even today"라고 답했다. vLLM은 전 세계 GPU 50만 장 위에서 돌고 있고, 상용 추론 클라우드와 API 서비스 상당수가 이 엔진을 그대로 내부에 쓴다. 오픈웨이트의 값어치로는 토큰 단가가 아니라 통제권을 꼽았다 — "for open weight, every provider can offer potentially even 10 different levels of speed". 속도 등급이 두 단계뿐인 프로프라이어터리 API와 달리 열 단계를 직접 설계할 수 있고, 데이터 보존·컴플라이언스·SLA까지 내 손에 들어온다는 이야기다.
💡오픈웨이트를 검토할 때 비교표 맨 윗줄을 토큰 단가에서 '통제권'으로 바꿔보세요. 응답 시간이 곧 계약 조건인 음성·실시간 워크로드라면, 속도 등급을 내가 정할 수 있는지가 그대로 제품 요건이 됩니다.
누가
인터뷰이: Simon Mo — Inferact 공동창업자·CEO, vLLM 리드 메인테이너 (UC Berkeley 출신) / 인터뷰어: Elena Burger(a16z 파트너), Matt Bornstein(a16z 제너럴 파트너) — 채널: a16z Podcast
무엇을
오픈소스 추론 엔진 vLLM이 연구 프로젝트에서 AI 인프라의 기간망이 된 과정, Kimi K3가 만든 오픈웨이트 경제학, Apache 2에서 상업 라이선스로 이동하는 모델 라이선싱, 에이전트 시대의 추론 확장, 증류(distillation) 논쟁
언제
2026-08-06 공개 (a16z Podcast 오디오 19:00 KST / YouTube 23:57 KST, 46분 49초)
Kimi K3·GLM 5.2 등 오픈웨이트 프런티어 모델이 쏟아지면서 '오픈 모델을 직접 굴릴 것인가, 프로프라이어터리 API에 붙을 것인가'가 지금 빌더의 실무 결정이 됐다. vLLM은 전 세계 GPU 50만 장 위에서 동시에 돌고 있고, 상용 추론 클라우드·API 서비스 상당수가 이 오픈소스 엔진을 내부에 그대로 쓰고 있다는 점을 당사자가 직접 확인해 준다.
#open-source#vllm#inference#interview

이 호가 도움됐다면 공유해 주세요.

📤 공유하기𝕏@inf💬B