Anthropic, Claude Opus 4.8 공개

Anthropic, Claude Opus 4.8 공개

Anthropic이 2026년 5월 28일 Claude Opus 4.8을 공개했다. Opus 4.7이 나온 지 그리 오래되지 않은 시점이지만, 이번 릴리스는 단순한 마이너 패치로 보기 어렵다. 코드 결함 감지 능력이 이전 모델 대비 약 4배 향상됐고, Fast Mode 가격은 3배 가량 낮아졌으며, Effort Control이라는 새로운 제어 메커니즘이 API 수준에서 도입됐다. 이번 릴리스에서 가장 눈에 띄는 개념은 Effort Control이다. … 더 읽기

AI 코딩 벤치마크를 믿을 수 없는 이유 – DeepSWE가 드러낸 불편한 진실

AI 코딩 벤치마크를 믿을 수 없는 이유 – DeepSWE가 드러낸 불편한 진실

GPT-5.5가 1위, DeepSeek V4 Pro가 꼴찌에서 두 번째. 기존 SWE-Bench 리더보드에서 익숙하게 보던 순서와 전혀 다른 결과가 나왔다. Datacurve가 공개한 DeepSWE 벤치마크 이야기다. 순위 자체보다 더 흥미로운 건 이 벤치마크가 드러낸 기존 평가 체계의 구조적 결함이다. 올바른 구현을 제출해도 네 번 중 한 번은 틀렸다고 판정받는 시스템 위에서 AI 코딩 능력을 비교해왔다는 것이 이번에 밝혀졌다. … 더 읽기

Claude Code 한도를 두 배로 — Code with Claude 2026 컨퍼런스 기술 정리

Claude Code 한도를 두 배로 — Code with Claude 2026 컨퍼런스 기술 정리

5월 6일 샌프란시스코에서 열린 Anthropic의 개발자 컨퍼런스 “Code with Claude 2026″은 모델 발표 없이도 꽤 밀도 높은 행사였다. 개발자들이 가장 먼저 반응한 건 Claude Code 사용 한도 두 배 인상이었지만, 그 뒤에 발표된 Managed Agents 세 기능과 Webhooks는 에이전트를 구축하는 방식 자체를 바꿀 수 있는 내용이었다. 컴퓨트 딜부터 각 기능의 기술적 세부사항까지 순서대로 정리한다. SpaceX … 더 읽기

Claude Code에 명령 하나로 Codex·Gemini를 동시에 굴리는 법

Claude Code에 명령 하나로 Codex·Gemini를 동시에 굴리는 법

지난글에 Claude, Gemini, Codex CLI를 멀티 모델 오케스트레이션 환경으로 묶는 방법을 정리한 적이 있다. 다시 읽어보니 실제 쓰는 방식과 많이 다르다. 그 글은 터미널에서 bash 파이프라인을 손으로 연결하는 접근이었는데, 실제로는 Claude Code에 목표만 말하면 나머지는 알아서 돌아간다. 뒤에서 어떤 CLI가 돌아가는지 신경 쓸 필요가 없다. 그 구조를 실제에 맞게 다시 정리한다. 실제 사용 방식 내가 … 더 읽기

Claude Code 슬래시 명령어 완전 정리 — 2026년 최신판

Claude Code 한도를 두 배로 — Code with Claude 2026 컨퍼런스 기술 정리

Claude Code를 쓰면서 /clear와 /help 외에 다른 명령어는 거의 안 쓴다는 사람이 많다. 사실 2026년 기준으로 내장 명령어만 20개가 넘고, 최근 몇 달 사이에 /doctor, /fast, /buddy 같은 실용적인 명령어들이 꽤 추가됐다. 알고 쓰는 것과 모르고 쓰는 것의 차이가 꽤 크다. 슬래시 명령어는 크게 네 종류로 나뉜다. Claude Code에 내장된 빌트인 명령어, 사용자가 직접 만드는 … 더 읽기

AI 에이전트에게 규율을 주입하는 법 — Claude Code Superpowers 플러그인

AI 에이전트에게 규율을 주입하는 법 — Claude Code Superpowers 플러그인

Claude Code를 처음 쓰다 보면 패턴 하나를 금방 알아챈다. 요청을 내리면 모델이 즉각 코드 작성에 뛰어든다. 빠르긴 한데, 방향이 틀리거나 맥락을 잘못 잡으면 되돌리는 데 더 많은 토큰이 들어간다. Superpowers는 이 실패 모드를 막겠다는 목적으로 만들어진 오픈소스 플러그인이다. 5월 4일 v5.1.0이 나왔다. Jesse Vincent가 만들고 Prime Radiant 팀이 함께 개발하는 이 프로젝트는 MIT 라이선스로 공개되어 … 더 읽기

코드를 읽지 않고 배포한다는 것

코드를 읽지 않고 배포한다는 것

“Claude Code에게 JSON API 엔드포인트를 작성해달라고 하면, 올바르게 작성된다는 걸 안다. 그래서 더 이상 모든 코드를 검토하지 않는다.” 이 문장을 Django 공동 창시자이자 개발자 커뮤니티의 대표적인 목소리인 Simon Willison이 썼다. Willison이 최근 자신의 블로그에 올린 글 제목은 “Vibe coding and agentic engineering are getting closer than I’d like”다. 직역하면 “바이브 코딩과 에이전트 엔지니어링이 내가 원하는 … 더 읽기

Multi-Model Orchestration: Running Claude, Gemini, and Codex CLI Together

Multi-Model Orchestration: Running Claude, Gemini, and Codex CLI Together

If you’re a developer these days, there’s a good chance you’re using at least one AI CLI daily. Command-line tools that let you call AI models directly from the terminal have become the new productivity standard — moving well beyond browser-based chat interfaces. But spend enough time with any single tool and one thing becomes … 더 읽기

Claude·Gemini·Codex CLI를 묶어 쓰는 멀티 모델 오케스트레이션 셋업 가이드

Multi-Model Orchestration: Running Claude, Gemini, and Codex CLI Together

요즘 개발자라면 AI CLI 한두 개쯤은 매일 쓰고 있을 것이다. ChatGPT나 Claude 웹 인터페이스를 넘어 터미널에서 직접 호출 가능한 명령줄 도구들이 생산성의 새로운 표준으로 자리잡았다. 그런데 한참 쓰다 보면 한 가지가 분명해진다. 어떤 모델 하나만 골라 쓰면 결국 어딘가에서 한계에 부딪힌다. 이미지 출처: Unsplash 이 글에서는 Claude Code, Gemini CLI, Codex CLI를 묶어서 멀티 모델 … 더 읽기

구글은 왜 Anthropic에 400억 달러를 더 베팅하나

자체 모델을 키우는 회사가 잠재적 경쟁자에 또 거액을 넣는다. 구글이 Claude를 만드는 Anthropic에 최대 400억 달러, 우리 돈으로 약 55조 원에 달하는 추가 투자를 협의 중이라는 소식이 전해졌다. 이미지 출처: Unsplash 구글은 이미 2023년에 5억 달러, 2024년에 20억 달러를 투자한 바 있다. 이번 라운드까지 마무리되면 누적 투자액은 단숨에 500억 달러를 넘긴다. AI 단일 기업에 들어간 … 더 읽기