DALL-E 끝났다 — gpt-image-2가 한글 텍스트까지 그리기 시작했다
OpenAI gpt-image-2가 Image Arena +242 ELO로 등판. 디퓨전 시대 종료, 한글 텍스트 90%+ 렌더링, 5월 12일 DALL-E 셧다운까지 정리.
OpenAI gpt-image-2가 Image Arena +242 ELO로 등판. 디퓨전 시대 종료, 한글 텍스트 90%+ 렌더링, 5월 12일 DALL-E 셧다운까지 정리.
2026년 4월, AI 업계가 숨죽여 지켜보는 한 글자짜리 키워드가 있다. Spud. OpenAI가 내부적으로 붙여 쓰는 차세대 모델의 코드네임이다. 이름 자체는 “감자” 정도의 장난스러운 의미지만, 이 감자가 세상을 뒤집을 가능성을 업계 전체가 진지하게 바라보고 있음. 직전 한 달간 판세는 Anthropic이 주도했다. Claude Opus 4.7의 SWE-bench 87.6%, Claude Code Cowork와 Routines, Claude … 더 보기
2026년 4월 16일, Anthropic이 Claude Opus 4.7을 공개함. Opus 4.6 공개 두 달 만의 업데이트인데, 점프 폭이 생각보다 큼. 한 문장으로 정리하면 이럼. 코딩 실력 또 한 단계 올라갔고, 비전 해상도 3배, 새 효율 레벨이 생겼고, 가격은 그대로. 그리고 내부에는 이미 더 센 모델(Mythos)이 돌아가는 중. 요약하면, 지금 현업 1인 … 더 보기
개인 프로젝트 몇 개가 시계열 예측에 묶여 있음. 국내·미국 주식 스크리닝, 코인 가격 브리핑, 야구 안타 예측, 스포츠 토토 승무패 분석까지 — 전부 과거 데이터로 다음을 맞추는 작업임. 매번 문제마다 XGBoost를 새로 학습시키는 게 귀찮아서 파운데이션 모델 쪽을 뒤지다가 Google이 오픈소스로 풀어둔 TimesFM을 다시 들여다보게 됐음. 4월 중순 기준 최신 … 더 보기
AI 모델이 너무 똑똑해서 공개를 안 한다? 영화 같은 이야기가 실제로 일어남. 2026년 4월 8일, Anthropic이 역대 최강 모델 Claude Mythos Preview를 발표했는데, 일반 공개는 하지 않겠다고 밝힘. 이유는 단순함. 이 모델이 발견한 보안 취약점이 너무 치명적이라, 잘못된 손에 들어가면 인터넷 인프라 전체가 위험해질 수 있기 때문. 미토스는 어떤 모델인가 … 더 보기
2월에 Anthropic이 Claude 4.6 시리즈를 연달아 출시했음. Opus 4.6이 2월 5일, Sonnet 4.6이 2월 17일. 이전 세대 대비 확실히 달라진 부분이 많은데, 특히 코딩과 에이전틱 작업 쪽에서 눈에 띄는 변화가 있음. 실제로 매일 쓰고 있는 입장에서 정리해봄. Claude Opus 4.6 — 코딩 특화 최강 모델 Opus 4.6은 Anthropic의 플래그십 모델. … 더 보기
3월 22일, 젠슨 황이 선언함. “우리는 AGI를 달성했다고 생각한다.” 48시간 뒤, ARC-AGI-3가 공개됨. 최고 AI의 점수: 0.37%. 인간: 100%. 같은 주에 일어난 일임. 이 두 사건을 나란히 놓고 보면, 지금 AI 업계에서 벌어지고 있는 “정의 전쟁”의 민낯이 드러남. 젠슨 황이 뭐라고 했나 렉스 프리드먼 팟캐스트 #494에서 나온 대화임. 3시간짜리 인터뷰 … 더 보기
Google이 Gemini 3.1 라인업을 내놓음. 2월에 Pro, 3월에 Flash-Lite. 두 모델 다 기존 대비 확실한 업그레이드인데, 방향이 다름. Pro는 추론 능력을 끌어올렸고, Flash-Lite는 가격과 속도를 극한까지 낮췄음. Google이 처음으로 “.1” 버전 증분을 쓴 것도 의미가 있음. 이전에는 2.0 → 2.5처럼 큰 단위로만 올렸는데, 이번에는 넓은 기능 확장 대신 지능 자체에 … 더 보기