코드를 읽지 않고 배포한다는 것

코드를 읽지 않고 배포한다는 것

“Claude Code에게 JSON API 엔드포인트를 작성해달라고 하면, 올바르게 작성된다는 걸 안다. 그래서 더 이상 모든 코드를 검토하지 않는다.” 이 문장을 Django 공동 창시자이자 개발자 커뮤니티의 대표적인 목소리인 Simon Willison이 썼다. Willison이 최근 자신의 블로그에 올린 글 제목은 “Vibe coding and agentic engineering are getting closer than I’d like”다. 직역하면 “바이브 코딩과 에이전트 엔지니어링이 내가 원하는 … 더 읽기

AI를 위한 역(逆) 법칙 세 가지

AI를 위한 역(逆) 법칙 세 가지

아이작 아시모프의 로봇 3법칙은 로봇이 지켜야 할 규칙이다. 그런데 AI가 일상 깊숙이 들어온 지금, 정작 규제가 필요한 건 AI가 아니라 AI를 쓰는 인간의 행동 방식일지도 모른다. 소프트웨어 엔지니어 Susam Pal이 올해 초 발표한 글 “Three Inverse Laws of AI”는 이 발상에서 출발한다. 그가 제안하는 세 가지 역법칙은 AI 시스템이 어떻게 행동해야 하는지가 아니라, 인간이 AI를 … 더 읽기

Gemma4의 추론 속도를 세 배 높이는 방법

Gemma4의 추론 속도를 세 배 높이는 방법

언어모델이 텍스트를 생성하는 방식은 본질적으로 순차적이다. 토큰 하나를 만들고, 그것을 바탕으로 다음 토큰을 만들고, 또 그것을 바탕으로 또 다음 토큰을 만든다. 모델이 아무리 크고 하드웨어가 아무리 좋아도, 이 구조 자체가 지연을 만들어낸다. 구글이 5월 5일 공개한 Gemma 4의 멀티-토큰 예측(MTP) 드래프터는 바로 이 병목을 정면으로 겨냥한다. 아이디어는 추측 디코딩(Speculative Decoding)에서 출발한다. 크고 정확한 타겟 모델이 … 더 읽기

Replacing Claude Haiku with Ollama gemma4:e4b — Web Search and File Exploration via Local LLM

Replacing Claude Haiku with Ollama gemma4:e4b — Web Search and File Exploration via Local LLM

At some point when you’re using the Claude Haiku API to filter web search results or narrow down relevant files in a codebase, a question creeps in: “Does this really need to go to a cloud API?” There’s also the nagging feeling that internal code or potentially sensitive file contents are passing through an external … 더 읽기

Claude Haiku 대신 Ollama gemma4:e4b — 웹서치와 파일 탐색을 로컬 LLM으로

Claude Haiku 대신 Ollama gemma4:e4b — 웹서치와 파일 탐색을 로컬 LLM으로

웹 검색 결과를 정리하거나, 코드베이스에서 관련 파일을 추려내는 작업에 클로드 하이쿠 API를 쓰다 보면 어느 순간 “이 정도 작업을 꼭 클라우드 API로 보내야 하나?”라는 의문이 든다. 민감할 수 있는 파일 내용이나 내부 코드가 외부 서버를 거친다는 점도 마음에 걸린다. 이미지 출처: Unsplash 마침 올라마(Ollama)에서 gemma4:e4b를 로컬에서 돌려본 뒤로 생각이 달라졌다. 반복성 높은 경량 작업에서는 하이쿠와 … 더 읽기

Bun이 걱정된다 — Anthropic 인수 이후를 바라보는 시선

Bun이 걱정된다 — Anthropic 인수 이후를 바라보는 시선

Bun은 Node.js 생태계에서 가장 빠르게 주목받은 JavaScript 런타임 중 하나다. 설치 속도, 번들링, 테스트 러너까지 하나로 묶은 구성이 개발자들 사이에서 빠르게 입소문을 탔다. 그런데 최근 한 개발자가 조용한 우려를 꺼냈다. 제목은 단순하다. “Bun이 걱정된다.” 이미지 출처: Unsplash 글의 핵심은 Anthropic의 인수 이후 Bun의 방향이 어떻게 달라질지에 대한 불안이다. 저자는 그 우려의 근거로 Claude Code의 변화를 … 더 읽기

AI 에이전트에게 시니어 엔지니어의 판단을 심는 법 — Agent Skills

AI 에이전트에게 시니어 엔지니어의 판단을 심는 법 — Agent Skills

AI 에이전트가 코드를 짜고 PR을 올리는 시대에, 에이전트가 “잘 작동한다”는 것의 기준은 무엇일까. Google Chrome팀의 Addy Osmani가 최근 이 질문에 정면으로 답하는 글을 내놨다. 이미지 출처: Unsplash 그가 말하는 “스킬(Skill)”은 단순한 문서가 아니다. 프론트매터(frontmatter)가 달린 마크다운 파일로, 특정 상황이 감지될 때 에이전트의 컨텍스트에 자동으로 주입되는 구조화된 워크플로우다. 차이는 미묘하지만 중요하다. “테스트를 잘 작성해야 한다”고 설명하는 … 더 읽기

실시간 음성 AI를 900만 명 규모로 — OpenAI의 저지연 인프라 설계

ChatGPT에서 실시간 음성 대화를 해본 적이 있다면, 그 응답 속도가 얼마나 많은 공학적 고민의 결과인지 체감하기 쉽지 않다. OpenAI가 이번 주 저지연 음성 AI를 대규모로 운영하는 방법을 상세히 공개했다. 이미지 출처: Unsplash 핵심 결정은 전통적인 SFU(Selective Forwarding Unit) 방식을 버리고 WebRTC 직접 트랜시버 연결을 택한 것이다. 기존 음성·영상 통화 인프라는 대부분 중간 서버가 미디어 스트림을 … 더 읽기

Multi-Model Orchestration: Running Claude, Gemini, and Codex CLI Together

Multi-Model Orchestration: Running Claude, Gemini, and Codex CLI Together

If you’re a developer these days, there’s a good chance you’re using at least one AI CLI daily. Command-line tools that let you call AI models directly from the terminal have become the new productivity standard — moving well beyond browser-based chat interfaces. But spend enough time with any single tool and one thing becomes … 더 읽기

AI 에이전트에 코딩을 맡기면 어떻게 되나 — “함정”이라는 주장

AI 코딩 에이전트가 코드를 짜주는 동안, 개발자는 어떤 능력을 잃어가고 있을까. Lars Faye는 최근 글에서 “에이전트 코딩은 함정”이라는 단호한 주장을 내놨다. 이미지 출처: Unsplash 핵심 논지는 ‘인지능력 약화(Cognitive Atrophy)’다. AI 에이전트에 코딩을 전적으로 위임하면 수개월 안에 디버깅 능력이 눈에 띄게 떨어지고, 코드가 동작하는 방식에 대한 명확한 정신 모델이 사라진다는 것이다. 그리고 여기서 역설이 생긴다. AI를 … 더 읽기