AI가 ER 의사보다 진단을 잘한다? — 하버드 연구의 67%를 둘러싼 논쟁

AI가 응급실 의사보다 진단 정확도가 높다는 하버드 연구가 나왔다. 수치만 보면 충격적이다. 그런데 연구 방법을 조금만 들여다보면 이야기가 꽤 달라진다. 이미지 출처: Unsplash 연구팀은 OpenAI의 o1 모델이 응급실 환자 케이스를 올바르게 진단한 비율이 67%로, 분류 담당 의사(triage doctor)의 50~55%보다 유의미하게 높았다고 발표했다. 수치만 떼어 놓으면 AI가 의사를 앞섰다는 인상을 주기에 충분하고, 실제로 많은 매체가 그렇게 … 더 읽기

C를 버리지 않고 더 안전하게 — Microsoft의 lib0xc 오픈소스 공개

“안전한 소프트웨어를 만들고 싶다면 C를 버리고 Rust로 가라.” 최근 몇 년 사이 미국 NSA, 백악관 사이버 보안 전략 보고서까지 이런 방향을 공식 권고하고 있다. Microsoft 역시 내부 신규 프로젝트에서 Rust 채택을 적극 장려해온 곳이다. 그런데 이번에 내놓은 패는 예상과 달랐다. 이미지 출처: Unsplash Microsoft는 이번 주 lib0xc를 GitHub에 오픈소스로 공개했다. “C 표준 라이브러리 인접 API들을 … 더 읽기

트랜스포머의 틀을 넘어 — Liquid AI의 LFM2-24B-A2B 공개

AI 언어 모델 경쟁에서 아키텍처 이야기가 다시 수면 위로 떠오르고 있다. 대형 모델 대부분이 트랜스포머(Transformer) 구조를 당연하게 채택하는 동안, Liquid AI는 처음부터 다른 길을 골랐다. 이미지 출처: Unsplash MIT 연구진이 2023년 창업한 이 보스턴 스타트업은 이번 주 LFM2-24B-A2B를 오픈 웨이트(Open Weights)로 공개했다. 이름을 풀면, LFM은 Liquid Foundation Model의 약자이고 24B-A2B는 전체 파라미터 240억 개 중 … 더 읽기

Claude·Gemini·Codex CLI를 묶어 쓰는 멀티 모델 오케스트레이션 셋업 가이드

Claude·Gemini·Codex CLI를 묶어 쓰는 멀티 모델 오케스트레이션 셋업 가이드

요즘 개발자라면 AI CLI 한두 개쯤은 매일 쓰고 있을 것이다. ChatGPT나 Claude 웹 인터페이스를 넘어 터미널에서 직접 호출 가능한 명령줄 도구들이 생산성의 새로운 표준으로 자리잡았다. 그런데 한참 쓰다 보면 한 가지가 분명해진다. 어떤 모델 하나만 골라 쓰면 결국 어딘가에서 한계에 부딪힌다. 이미지 출처: Unsplash 이 글에서는 Claude Code, Gemini CLI, Codex CLI를 묶어서 멀티 모델 … 더 읽기

구글은 왜 Anthropic에 400억 달러를 더 베팅하나

자체 모델을 키우는 회사가 잠재적 경쟁자에 또 거액을 넣는다. 구글이 Claude를 만드는 Anthropic에 최대 400억 달러, 우리 돈으로 약 55조 원에 달하는 추가 투자를 협의 중이라는 소식이 전해졌다. 이미지 출처: Unsplash 구글은 이미 2023년에 5억 달러, 2024년에 20억 달러를 투자한 바 있다. 이번 라운드까지 마무리되면 누적 투자액은 단숨에 500억 달러를 넘긴다. AI 단일 기업에 들어간 … 더 읽기