endueendue

에이전트

AI 에이전트를 만들고, 돌리고, 지켜보는 일.

글 22편

업계 동향 · 에이전트

Gemini 4 Argon 리뷰: 에이전트를 운영하는 팀이 지금 결정할 수 있는 것

발표 사흘째의 Gemini 4 Argon 을 운영자의 눈으로 다시 봤습니다. 작업 유형별로 어디가 강하고 어디가 약한지, 작업 하나에 실제로 얼마가 드는지, 출력 100만 토큰과 가드레일 없는 버전이 운영에 무엇을 뜻하는지, 그리고 API 가 열리기 전에 오늘 준비할 수 있는 것을 정리했습니다.

12분 분량

제품 · 에이전트

한 번 익히면 그대로인 화면: endue 콘솔 둘러보기와 자리를 지키는 이유

홈 보드, 대화, 승인 카드, 스튜디오 캔버스, 스페이스까지 endue 콘솔을 한 바퀴 돌며 어떤 화면이 어디에 있는지 설명합니다. 에이전트 제품에서 UI 가 왜 통제 장치인지, 자리가 그대로인 화면이 하루에 몇 분을 아끼는지 계산하고, 다른 AI 앱의 화면이 지난 넉 달 동안 얼마나 자주 바뀌었는지 날짜로 확인합니다.

9분 분량

제품 · 에이전트

분석·작성·검토를 나눠 맡기는 나만의 AI 팀: endue Space

에이전트 여러 명에게 역할을 주고 하나의 결과물을 맡겨 보세요. endue Space 에서 분석 자료가 초안으로 이어지고, 검토 의견에 따라 수정되는 과정과 결과 버전 관리까지 실제 UI 로 살펴봅니다.

5분 분량

제품 · 에이전트

내가 만든 AI 를 다른 사람에게 서비스하기: endue Live

내 지식과 일하는 방식을 담은 에이전트를 링크 하나로 공개하세요. 방문자는 가입 없이 대화하고, 나는 에이전트의 지침·도구·공개 여부를 관리합니다. endue Live 로 첫 AI 서비스를 여는 과정을 실제 화면으로 살펴봅니다.

5분 분량

제품 · 에이전트 · 엔지니어링

내 앱의 버튼 뒤에 내가 만든 AI 를: endue Agent API

endue 에서 다듬은 에이전트를 내 앱과 업무 도구에 연결하세요. 전용 API 키, 이어지는 대화, 호출 기록을 실제 UI 로 살펴보고, 작은 계획 도우미를 서비스에 붙이는 예제로 시작합니다.

5분 분량

업계 동향 · 에이전트

Gemini 4 Argon 깊이 읽기: 벤치마크 18개, 출력 100만 토큰, 단계적 출시

구글의 첫 Gemini 4 모델은 자사 표의 벤치마크 18개 중 12개에서 1위를 했고, 공개 리더보드도 대체로 같은 쪽을 가리킵니다. 이 글은 누가 어떤 조건으로 쟀는지, 작업 하나에 토큰을 얼마나 쓰는지, 100만 토큰짜리 응답 한 번이 얼마인지, 왜 지금은 사이버 방어 팀만 쓸 수 있는지 정리했습니다.

17분 분량

업계 동향 · 에이전트

OpenAI Dots 는 어떻게 동작하나: 엔지니어 눈으로 본 상시 에이전트

출시 사흘째 Dots 를 하나의 시스템으로 뜯어봤습니다. dot 마다 붙는 클라우드 컴퓨터, 목표가 실제 행동으로 바뀌는 경로, 그 사이에 놓인 검사 단계, OpenAI 자체 시험이 보여 주는 약점, DevDay 이후 바뀐 것, 같은 걸 직접 만들 때 필요한 부품까지 정리했습니다.

13분 분량

업계 동향 · 에이전트

ChatGPT Space 는 어떻게 동작하나: 페이지, 권한, 그 안의 에이전트

출시 사흘째인 ChatGPT Space 를 엔지니어 눈으로 뜯어봤습니다. space 와 페이지, 파일이 어떻게 엮이는지, 권한이 어떻게 상속되는지, 각자의 에이전트가 무엇을 보는지, Compliance API 가 무엇을 내보내는지 정리했습니다. 내보내기와 버전 기록처럼 아직 없는 기능도 함께 짚었습니다.

12분 분량

업계 동향 · 에이전트

Dots 출시 다음 날: 안전 우려, 개인정보 FAQ, 켜기 전 점검표

OpenAI 는 GPT-6.1 Astra 출시를 보류하고 호주 정부에 사과한 다음 날 Dots 를 내놨습니다. 시스템 카드의 안전 평가 수치와 개인정보 FAQ 의 실제 문장, 시연이 멈추고 장애가 이어진 첫날을 정리하고, 켜기 전에 확인할 점검표를 도움말 문서 기준으로 만들었습니다.

9분 분량

업계 동향 · 에이전트

OpenAI Dots 정리, 늘 켜져 있는 ChatGPT 에이전트는 무엇이 다른가

OpenAI 가 DevDay 에서 공개한 Dots 는 자기 클라우드 컴퓨터를 가진 채 ChatGPT·Slack·Teams 에서 늘 대기하며 일을 이어 가는 에이전트입니다. 무엇을 맡길 수 있는지, 누가 쓸 수 있는지, 권한과 승인은 어떻게 다루는지 정리했습니다.

7분 분량

업계 동향 · 에이전트

ChatGPT Space 와 Pages, 팀과 에이전트가 같은 문서에서 일하는 법

OpenAI 가 DevDay 에서 ChatGPT 안의 협업 공간 Space 와 새 문서 형식 Pages 를 공개했습니다. 무엇을 할 수 있는지, 지금 쓸 수 있는 것과 곧 나올 것, 팀 작업과 Slack·Teams 연동, 권한과 개인정보까지 정리했습니다.

7분 분량

업계 동향 · 에이전트

노트북을 덮어도 일하는 Codex, DevDay 2026 업데이트 정리

OpenAI 가 DevDay 2026 에서 Codex 를 크게 손봤습니다. 팀이 함께 쓰는 클라우드 개발 환경, 음성과 에이전트 목록이 들어간 CLI, 데스크톱 앱의 코드 리뷰, GitHub 저장소를 훑는 Codex Security Cloud 까지 무엇이 바뀌었고 누가 쓸 수 있는지 정리했습니다.

8분 분량

업계 동향 · 에이전트

OpenAI 가 내놓은 결정 모델 Decisions API, Jev 와 나란히 보기

OpenAI 가 DevDay 에서 Luna 기반 Decisions API 를 제한 프리뷰로 공개했습니다. 정해 둔 보기 가운데 하나를 빠르게 고르고 이미지도 받습니다. 공개된 내용과 첫 비교 테스트, Jev 와 다른 점, 아직 발표되지 않은 것을 정리했습니다.

5분 분량

업계 동향 · 에이전트

Jev 활용 가이드, LLM 비용은 줄이고 3D 캐릭터 반응은 빠르게

TypeSafe 의 Jev 는 정해 둔 보기 가운데 하나를 0.5초 안에 고르는 결정 모델입니다. LLM 비용을 줄이는 라우터, 3D 캐릭터의 빠른 반응, 가드레일로 쓰는 방법과 한계를 도식과 함께 정리했습니다.

10분 분량

업계 동향 · 에이전트

Sonnet 5.5 가 Opus 를 앞선 날, 모델은 이제 어떻게 고를까

Claude Sonnet 5.5 가 Opus 5.5 의 절반 가격으로 한 벤치마크에서 Opus 를 앞섰습니다. 그런데 설정에 따라서는 작업 하나에 드는 돈이 오히려 더 많습니다. 발표된 숫자와 독립 측정을 나란히 놓고 모델 고르는 순서를 정리했습니다.

5분 분량

에이전트 · 제품

멀티 에이전트, 언제 나누고 어떻게 맡길까

에이전트 수를 늘린다고 일이 저절로 빨라지지는 않습니다. Anthropic 과 Cognition, 최근 연구가 말하는 원칙 여섯 가지를 정리하고, endue 가 그 원칙대로 에이전트를 구성하는 방식을 소개합니다.

7분 분량

업계 동향 · 에이전트

GPT-6 Astra 와 Unity, 3D 작업에서 달라지는 것들

OpenAI 의 새 모델은 Unity 씬을 고치고 직접 플레이해 본 뒤 깨진 곳을 다시 고칩니다. 공개된 사례가 보여 주는 것과 성과가 나온 이유, 우리 팀이 따라 해 보려면 무엇부터 준비할지 정리했습니다.

5분 분량