Codex 44

OpenAI, Codex 모델 컨텍스트 크기를 372k에서 272k로 축소 — 무엇이 달라졌고 개발자는 어떻게 대응해야 할까

OpenAI의 코딩 어시스턴트 Codex가 모델 메타데이터를 조용히 바꿨습니다. 7월 20일자로 머지된 PR #33972는 agent/hotfix-0.144-model-metadata 브랜치에서 372k → 272k로 컨텍스트 크기를 줄였고, 이 변경은 release/0.144 브랜치로 백포트됐습니다. 100k 토큰이 줄어든 건데, 이는 단순한 스펙 조정이 아니라 “Codex가 한 번에 다룰 수 있는 작업의 규모” 자체를 재정의한 것에 가깝습니다.OpenAI Codex의 번들 모델 메타데이터를 갱신하면서 모델 컨텍스트 크기를 372k에서 272k로 줄인 변경을 release/0.144 브랜치에 백포트함 PR #33972는 agent/hotfix-0.144-model-metadata 브랜치에서 Codex ..

AI 뉴스 2026.07.21

Weave Router — 프롬프트마다 최적의 모델로 자동 라우팅하는 LLM 프록시

LLM 에이전트를 운영하다 보면 한 가지 모델에 묶여있기가 어렵습니다. 추론이 깊어야 하는 요청은 Claude Opus, 비용이 민감한 일상 작업은 Gemini Flash나 OSS 모델이 더 효율적이기 때문입니다. 그런데 매번 개발자가 모델을 직접 갈아끼우는 건 비효율적이고, 에이전트 코드에 공급자 분기를 박아두면 곧 굳어버립니다.Weave Router는 이 문제를 단일 드롭인 프록시로 풀어낸 오픈소스 도구입니다. Anthropic Messages, OpenAI Chat Completions, Gemini native 세 API를 모두 받아서 한 번에 라우팅하고, 매 요청을 50ms 이내에 가장 적합한 모델로 보냅니다. 포인트는 단순한 키워드 매칭이 아니라 on-box embedder + 클러스터 스코어..

AI 뉴스 2026.07.09

GPT-5.6 Sol Ultra, Codex에 자동 sub-agent 오케스트레이션을 가져오다

GPT-5.6 Sol Ultra, Codex에 들어오다OpenAI의 Codex 담당 Thibault Sottiaux(Tibo)는 최근 트위터에서 "Ultra will be in codex"라고 못 박았습니다. GPT-5.5 Pro가 Codex 라인업에서 빠져 있던 사이 사용자 불만이 커졌고, 그 자리에 GPT-5.6 Sol Ultra가 채워질 예정이라는 의미입니다. 단순 모델 추가가 아니라 sub-agent 오케스트레이션이 기본값으로 켜진 모드라는 점에서 주목할 만합니다.한 사용자는 Codex의 높은 사용량 한도와 잦은 리셋을 근거로 "Claude Max 20x 플랜을 결제할 이유가 사실상 없다"고까지 말했습니다. 5.6 Pro 또는 Sol Ultra가 Codex에 포함되기만 하면, 코딩 에이전트 시장 ..

AI 뉴스 2026.07.08

GLM 5.2와 AI 추론 마진 붕괴 — 오픈 가중치가 프런티어 랩의 가격 구조를 흔든다

Z.ai의 GLM 5.2가 단순한 오픈 가중치 모델을 넘어, Opus·GPT급 에이전트 작업에 근접하면서 폐쇄형 프런티어 랩의 추론 마진에 직접적인 압박을 가하고 있다. 가격은 $4.40/MTok으로 Opus 소매가의 20% 미만, GPT 5.5의 약 15% 수준이다. 이번 글에서는 GLM 5.2가 실제로 보여준 품질, 남아있는 약점, 그리고 오픈 가중치 모델 전환의 비용 구조가 왜 업계의 마진 모델을 근본적으로 흔들 수 있는지 정리한다.학습비가 아니라 추론비가 진짜 비용이다DeepSeek R1 시절, "V3 학습비가 600만 달러 미만"이라는 보도가 돌면서 대규모 학습 투자가 끝났다는 해석이 나왔다. 하지만 이는 AI 비용 구조를 잘못 읽은 해석이다.학습 비용은 자본이 크지만 기본적으로 선불 고정비다...

AI 뉴스 2026.07.07

Orch term — 한 창에서 AI 코딩 에이전트 여러 대를 조율하는 멀티에이전트 워크스테이션

도입 — 한 터미널에 AI 한 대로는 부족하다Claude Code, Codex, Gemini CLI 같은 코딩 에이전트를 매일 붙여 쓰는 개발자라면 한 번쯤 부딪히는 벽이 있습니다. "터미널 하나에 에이전트 하나"라는 1:1 모델이 실제 작업 흐름과 맞지 않는다는 점입니다. 백엔드 코드 리뷰는 codex에게 맡기면서 동시에 프론트엔드 리팩토링은 claude에게 부탁하고, 그 사이 git 변경분은 사람이 직접 봐야 합니다. 탭 5개를 오가며 컨텍스트를 잃지 않는 것 자체가 일이 됩니다.2026년 6월 29일 긱뉴스에 소개된 Orch term (zendy 작성) 은 이 문제를 "한 창에 다 모아보자"는 방향으로 푼 데스크톱 앱입니다. Tauri 2 (Rust 백엔드) + TypeScript/Vite, xte..

AI 뉴스 2026.06.30

Show GN: Peck - PR을 쉽게 설명하고 리뷰 초안과 상태를 보여주는 macOS 메뉴바 앱

Peck - 메뉴바에서 깨어 있는 PR 리뷰 에이전트PR 리뷰를 시작할 때 제일 먼저 필요한 건 "이 PR이 뭘 바꾸는지"를 빠르게 이해하는 것이라고 생각한다. 그런데 실제로는 diff를 열고, 파일을 훑고, 관련 맥락을 따라가야 해서 리뷰를 시작하기 전부터 시간이 꽤 걸린다. 2026년 6월 현재, 깃헙 사용자는 평균 하루 3건 이상의 PR 리뷰 요청을 받는다 — 그 매번을 git fetch → gh pr view → diff 읽기로 시작하는 건 명백한 비효율이다.Peck은 이런 문제를 macOS 메뉴바에서 해결하는 SwiftUI 네이티브 앱이다. Electron 없이, 서버 없이, 계정 없이, GitHub CLI 로그인만으로 PR 목록을 메뉴바에 띄우고 AI가 리뷰 초안을 작성한다. 마스코트는 병아리..

Show GN: ax-grep, 에이전트 웹 검색 토큰 사용량을 3배 개선해주는 리서치 툴

ax-grep: 에이전트 웹 리서치 토큰 비용을 3분의 1로 줄여주는 도구2026년 6월 기준, 에이전트가 웹을 탐색할 때 한 번 페이지를 열면 컨텍스트 창이 순식간에 채워진다. ax-grep은 브라우저의 접근성 트리(Accessibility Tree)와 유사한 압축 트리를 브라우저 없이 만들어내고, 로컬 벤치마크에서 피크 RAM을 15.4배 적게 쓰면서 의사결정 토큰은 3분의 1로 줄여준다. 긱뉴스에서 hmmhmmhm이 Show GN으로 공개한 이 프로젝트는 단순한 HTML 파서가 아니라, 에이전트에게 "읽을 거리"만 남겨주는 사전 필터다.ax-grep이 해결하는 문제: 왜 토큰이 폭발하는가전통적인 에이전트 웹 검색은 두 가지 비효율을 동시에 안고 간다. 첫째는 메모리 비효율 — 일반 HTML 파서가 ..

AI 뉴스 2026.06.23

Show GN: opencodex — Codex에서 아무 LLM이나 쓸 수 있는 로컬 프록시

Codex는 기본적으로 OpenAI 모델만 쓸 수 있다. Claude나 GLM, Gemini로 코딩하고 싶으면 OpenAI가 공식 어댑터를 추가해줄 때까지 기다려야 한다는 뜻이다. 2026년 6월 현재, 이 답답함을 풀어줄 로컬 프록시 opencodex가 깃허브에 올라왔다. Codex와 외부 LLM 프로바이더 사이에 끼어들어 Responses API를 실시간으로 번역해 주는 도구로, npm 한 줄로 설치하고 ocx 명령어 두세 개면 Codex 환경 전체가 멀티 프로바이더로 전환된다.opencodex란 무엇인가opencodex는 Codex Responses API(/v1/responses)를 다른 LLM 프로토콜로 양방향 번역하는 로컬 프록시다. Codex 자체는 Responses API 하나만 받아들이지..

AI 뉴스 2026.06.23

im-ai-copyeditor: LLM이 모든 문장을 한 줄씩 읽고 다듬는 한글 교정 스킬

im-ai-copyeditor: LLM이 모든 문장을 한 줄씩 읽고 다듬는 한글 교정 스킬2026년 6월 현재, AI가 쓴 글이든 사람이 쓴 글이든 한 문장도 빠뜨리지 않고 다듬는 한국어 특화 스킬이 등장했습니다. Turtle-Hwan이 만든 im-ai-copyeditor는 정규식으로 한꺼번에 치환하는 기존 도구와 달리, 문장 부호 단위로 작업을 잘라 LLM이 위에서 아래로 한 줄씩 읽고 고친 뒤 다시 한 편으로 이어 붙입니다. 긱뉴스 HN 댓글에서 13시간 만에 7포인트와 3개의 응원이 붙은 뜨거운 주제입니다.핵심 차별점은 단순합니다. grep으로 훑지 않고 모든 문장을 LLM이 읽는다는 한 마디로 요약됩니다. 맞춤법 검사기는 종종 단어를 빠뜨리고, LLM은 한 번에 긴 본문을 받으면 어중간한 문장을 ..

AI 뉴스 2026.06.23

Show GN: 토스증권 Open API용 Agent Skill — 에이전트가 호출하는 한국 증권 API 첫걸음

2026년 6월 현재 토스증권이 Open API를 공개하면서 Codex, Claude Code 같은 코딩 에이전트가 한국 주식 조회·주문을 직접 다룰 길이 열렸습니다. 깃헙에서 화제가 된 BEOKS/tossinvest-skill 저장소는 그 API를 Agent Skill 형태로 한 번 감싸 설치 한 줄로 에이전트에 붙일 수 있게 해줍니다. SKILL.md + 공식 OpenAPI JSON + 표준 라이브러리 기반 CLI + 주문 dry-run 안전장치까지 한 묶음이라 "에이전트가 한국 주식을 만져도 되는가"라는 질문에 현실적인 답을 줍니다.Agent Skill이란 — 토스증권 API를 에이전트에 붙이는 방식기존에는 토스증권 Open API를 쓰려면 OAuth2 토큰 발급 → 엔드포인트 문서 직접 탐색 → ..