본문으로 건너뛰기
← 뉴스레터 목록

Issue #49 · 2026-07-24 · 2026. 7. 24.

vibecamp ai builder 2026-07-24 — 이미지·영상·오디오 통합 FLUX 3 공개, 로봇 액션 모델 FLUX-m

2026-07-24 AI 빌더 일간 호 — 오늘 8개 카드를 정리했습니다.

📤 공유하기𝕏@inf💬B
🛠

최신 기술 트렌드

이미지·영상·오디오 통합 FLUX 3 공개, 로봇 액션 모델 FLUX-mimic까지

Black Forest Labs가 7/23 이미지·비디오·오디오를 단일 아키텍처로 함께 학습하는 멀티모달 파운데이션 모델(multimodal foundation model) FLUX 3를 Early Access로 공개했습니다. 네이티브 오디오가 포함된 최대 20초 영상을 text-to-video로 생성하고 Runway Gen-4.5 대비 77% 비교에서 우세했습니다. 같은 날 mimic robotics와 만든 로봇 video-action 모델 FLUX-mimic도 Audi 공장에 실제 배포했는데, 기존 30시간+가 필요하던 조작 태스크를 단 30분 데이터로 파인튜닝하고 RTX 5090 단일 GPU에서 backbone <80ms(엔드투엔드 101ms)로 구동합니다.
💡생성형 AI 랩이 로봇 액션까지 단일 백본으로 확장했습니다. 30분 데이터·단일 GPU 온프레미스 구동이라 생성 AI와 물리 AI(physical AI)의 경계가 좁혀지는 지점을 직접 확인할 수 있습니다.
누가
Black Forest Labs (로봇 부문은 mimic robotics 공동, Audi 공장 배포)
무엇을
이미지·비디오·오디오를 통합 학습하는 멀티모달 파운데이션 모델 FLUX 3 와 그 위에 세운 로봇 video-action 모델 FLUX-mimic 공개
언제
2026-07-23 (Early Access 공개)
이미지 생성 전문 랩이 단일 통합 아키텍처로 비디오·오디오·로봇 액션까지 확장하고, world model 기반 물리 AI(physical AI)로 진출하기 위해
#multimodal#video-generation#robotics#flux#physical-ai

Claude 음성 모드에 Opus·Sonnet 개방 + Gmail·Slack·Canva 연동

Anthropic이 7/23 Claude 음성 모드에 처음으로 Opus·Sonnet 모델을 개방했습니다. 그동안 음성 모드는 즉답 위주의 Haiku만 지원했지만, 이제 모델 피커에서 Haiku/Sonnet/Opus를 대화 중간에도 전환할 수 있습니다. 음성 모드가 Gmail·Slack·Canva 등 커넥터(connector)에서 사용자 허가 하에 컨텍스트를 끌어오고, 11개 언어를 지원하며 언어 전환도 됩니다. 텍스트↔음성 모드를 대화 중간에 오갈 수 있고, turn-based 아키텍처(듣기→생각→응답)로 모바일·데스크톱·웹 전반에 배포됐습니다.
💡음성이 텍스트와 동급의 개발 표면(surface)으로 올라섰습니다. Claude로 에이전트·워크플로를 만든다면 음성 인터페이스에서도 강력 모델과 커넥터 도구 호출을 그대로 결합할 수 있습니다.
누가
Anthropic
무엇을
Claude 음성 모드에 Opus·Sonnet 모델과 Gmail·Slack·Canva 커넥터 연동을 추가
언제
2026-07-23 (Anthropic 공식 발표)
즉답형 Haiku 로만 돌던 음성 모드를 텍스트 수준의 심층 추론과 실제 앱 컨텍스트까지 다루도록 끌어올려, 음성 인터페이스에서도 복잡한 문제 해결을 지원하기 위해
#claude#voice#anthropic#connectors#agent

Microsoft, PowerPoint·Bing의 OpenAI 이미지 모델을 자체 MAI-Image-2.5로 교체

Microsoft가 7/23 PowerPoint·Bing에 쓰이던 OpenAI 이미지 생성 모델을 자체 기술 MAI-Image-2.5로 교체 중이라고 Bloomberg가 보도했습니다. 이 모델은 이미 PowerPoint·OneDrive에 임베드됐고, Microsoft AI CEO Mustafa Suleyman은 '더 빠르고 더 싸고 더 높은 품질이며 리텐션을 개선한다'고 밝혔습니다. Excel·Outlook·GitHub Copilot에서 OpenAI·Anthropic 모델을 자체 MAI로 바꿔 비용을 줄이려는 전략의 일부로, Suleyman은 'Anthropic에 많은 돈을 지불한다 — 목표는 그 비용을 줄이고 궁극적으로 제거하는 것'이라고 말했습니다. MAI 모델군은 2026년 6월 Build에서 처음 공개됐습니다.
💡대형 플랫폼이 프런티어 벤더 의존을 자체 모델로 수직통합하는 흐름이 이미지 도메인까지 번졌습니다. Microsoft 스택 위에서 만드는 빌더라면 이미지 생성 백엔드가 바뀌는 것을 체감하게 됩니다.
누가
Microsoft (Microsoft AI CEO Mustafa Suleyman)
무엇을
PowerPoint·Bing 의 OpenAI 이미지 생성 모델을 자체 MAI-Image-2.5 로 교체
언제
2026-07-23 (Bloomberg 보도, 교체는 7월 진행 중)
OpenAI·Anthropic API 지불 비용을 줄이고 궁극적으로 제거하며, 속도·비용·품질에서 자체 모델 우위를 확보하기 위해
#microsoft#image-generation#vertical-integration#mai#cost
🏆

해커톤·대회

코드게이트 CTF 2026 — 인간 화이트햇 vs KAIST AI 해커 첫 정식 대결

코드게이트 CTF 2026(18회) 본선이 7/23 오전 9시부터 7/24 오전 9시까지 24시간 동안 서울 코엑스에서 진행 중입니다. 일반부 21개 팀이 참가했고, KAIST와 공동 개발한 'AI 해커'가 국내 최초로 인간 화이트햇과 같은 환경에서 겨루는 Jeopardy(문제풀이형) 대결을 벌입니다. AI 해커는 오전 10시 30분 750점 18위에서 오후 2시 7위로 급상승했고, 다이내믹 스코어링(많이 풀수록 배점 하락) 방식이라 순위가 수시로 바뀝니다. 최종 순위는 7/24 오전 종료 후 확정됩니다. 일반부 상금은 우승 5,000만원입니다.
💡자율 보안 에이전트가 인간 전문가와 대등한 순위권에 오른 첫 국내 사례입니다. '취약점 자동 탐색' 에이전트의 현재 실력 수준을 가늠할 벤치마크성 이벤트로 참고할 수 있습니다.
누가
한컴그룹(코드게이트보안포럼) 주최. 일반부 21개 팀 참가 — 예선 상위 19팀 + KAIST와 공동 개발한 'AI 해커' + 1팀.
무엇을
국내 최초로 자율 'AI 해커'가 인간 화이트햇 해커와 동일 환경에서 취약점을 찾아 플래그를 획득하는 Jeopardy형 CTF 정식 대결. AI가 오전 18위→오후 7위로 급상승하며 상위권 경쟁.
언제
본선(일반부): 2026-07-23 09:00 ~ 07-24 09:00 (24시간, KST). 취재 시점 07-23 오후 2시 기준 AI 해커 7위. 최종 결과는 07-24 오전 확정 예정.
AI가 실제 보안 취약점 탐색·공략에서 최상위 인간 해커와 어느 정도 경쟁 가능한지를 실전 CTF 환경에서 검증. '보안'을 AI 3대 강국 전략의 축으로 제시.
#ctf#security#ai-agent#codegate#korea
🎙

기술+사람 인터뷰

리사 수 × 샘 올트먼: AMD 'Advancing AI 2026' 키노트 대담

AMD가 7/23 샌프란시스코 'Advancing AI 2026' 키노트에서 MI400 가속기, Helios 랙스케일 시스템, TSMC 2나노 기반 x86 서버 CPU EPYC Venice를 공개했습니다. 리사 수 CEO가 무대에 OpenAI CEO 샘 올트먼과 공동창업자 그레그 브록만을 초청해 대담했고, OpenAI는 최대 6GW의 AMD 인프라를 배치하며 2026년 4분기부터 Helios를 가동한다고 밝혔습니다. Meta는 Venice·MI450 리드 파트너로 참여했고, OpenAI와 Meta는 합산 12GW 가속기 용량을 커밋했습니다. 리사 수는 MI300X 대비 1,000배 성능을 주장하는 MI500 로드맵도 예고했습니다.
💡빌더가 가져갈 멘탈 모델: 모델·에이전트 성능은 결국 확보 가능한 컴퓨트와 공급 계약 규모에 종속됩니다. 인프라 계층의 벤더 다변화·물량 커밋을 읽으면 프런티어 역량의 상한선을 역산할 수 있습니다.
누가
인터뷰이: Lisa Su(AMD 회장·CEO), 특별 게스트 Sam Altman(OpenAI CEO)·Greg Brockman(OpenAI 사장·공동창업자) / 진행 채널: AMD Advancing AI 2026 키노트
무엇을
MI400·Helios·EPYC Venice 발표와 함께 OpenAI(최대 6GW)·Meta(합산 12GW) 대규모 컴퓨트 파트너십을 온스테이지 대담으로 공개
언제
2026-07-23 09:30 PT (16:30 UTC) 라이브 키노트 공개 (AMD Advancing AI 2026)
엔비디아 독점 구도가 굳어진 가운데 프런티어 랩(OpenAI·Meta)이 AMD에 12GW를 커밋했다는 점이 '에이전틱 AI 시대'의 컴퓨트 공급 병목과 멀티벤더 전략 전환을 상징하기 때문 — 발표 당일의 시의성
#amd#compute#openai#keynote#infrastructure

이 호가 도움됐다면 공유해 주세요.

📤 공유하기𝕏@inf💬B