endueendue

업계 동향

새 모델과 도구, 연구가 에이전트와 일하는 팀에게 어떤 의미인지.

글 20편

업계 동향 · 에이전트

Gemini 4 Argon 리뷰: 에이전트를 운영하는 팀이 지금 결정할 수 있는 것

발표 사흘째의 Gemini 4 Argon 을 운영자의 눈으로 다시 봤습니다. 작업 유형별로 어디가 강하고 어디가 약한지, 작업 하나에 실제로 얼마가 드는지, 출력 100만 토큰과 가드레일 없는 버전이 운영에 무엇을 뜻하는지, 그리고 API 가 열리기 전에 오늘 준비할 수 있는 것을 정리했습니다.

12분 분량

업계 동향

Gemini 4 Argon 브리핑: 구글이 낸 숫자와 첫 반응

구글의 첫 Gemini 4 모델이 자사가 공개한 벤치마크 18개 중 12개에서 1위를 했습니다. 응답 하나에 최대 100만 토큰을 쓰고, 가격은 100만 토큰당 2달러·10달러부터입니다. 지금은 검증된 사이버 방어 팀만 씁니다. 핵심 숫자와 독립 평가 결과, 회의적인 시선까지 짧게 정리했습니다.

5분 분량

업계 동향 · 에이전트

Gemini 4 Argon 깊이 읽기: 벤치마크 18개, 출력 100만 토큰, 단계적 출시

구글의 첫 Gemini 4 모델은 자사 표의 벤치마크 18개 중 12개에서 1위를 했고, 공개 리더보드도 대체로 같은 쪽을 가리킵니다. 이 글은 누가 어떤 조건으로 쟀는지, 작업 하나에 토큰을 얼마나 쓰는지, 100만 토큰짜리 응답 한 번이 얼마인지, 왜 지금은 사이버 방어 팀만 쓸 수 있는지 정리했습니다.

17분 분량

업계 동향 · 에이전트

OpenAI Dots 는 어떻게 동작하나: 엔지니어 눈으로 본 상시 에이전트

출시 사흘째 Dots 를 하나의 시스템으로 뜯어봤습니다. dot 마다 붙는 클라우드 컴퓨터, 목표가 실제 행동으로 바뀌는 경로, 그 사이에 놓인 검사 단계, OpenAI 자체 시험이 보여 주는 약점, DevDay 이후 바뀐 것, 같은 걸 직접 만들 때 필요한 부품까지 정리했습니다.

13분 분량

업계 동향 · 에이전트

ChatGPT Space 는 어떻게 동작하나: 페이지, 권한, 그 안의 에이전트

출시 사흘째인 ChatGPT Space 를 엔지니어 눈으로 뜯어봤습니다. space 와 페이지, 파일이 어떻게 엮이는지, 권한이 어떻게 상속되는지, 각자의 에이전트가 무엇을 보는지, Compliance API 가 무엇을 내보내는지 정리했습니다. 내보내기와 버전 기록처럼 아직 없는 기능도 함께 짚었습니다.

12분 분량

업계 동향 · 엔지니어링

GPT-6.1 Sol 출시 하루 뒤, 독립 평가와 초기 사용자들이 확인한 것

독립 평가에서 GPT-6.1 Sol 은 GPT-6 Astra 보다 1점 낮은 점수를 Astra 의 4분의 1 미만인 과제당 비용으로 냈습니다. 정가가 같은 Claude Sonnet 5.5 와는 과제당 비용이 10배 넘게 벌어졌습니다. 사용자 테스트와 실사용 데이터, 모델을 바꿀 때 걸리는 설정, 발표에서 덜 다뤄진 안전성 수치까지 정리했습니다.

15분 분량

업계 동향 · 에이전트

Dots 출시 다음 날: 안전 우려, 개인정보 FAQ, 켜기 전 점검표

OpenAI 는 GPT-6.1 Astra 출시를 보류하고 호주 정부에 사과한 다음 날 Dots 를 내놨습니다. 시스템 카드의 안전 평가 수치와 개인정보 FAQ 의 실제 문장, 시연이 멈추고 장애가 이어진 첫날을 정리하고, 켜기 전에 확인할 점검표를 도움말 문서 기준으로 만들었습니다.

9분 분량

업계 동향

OpenAI DevDay 2026, 발표 25가지 한눈에 보기

9월 29일(현지 시각) DevDay 에서 OpenAI 가 발표한 내용을 다섯 갈래로 정리했습니다. 항상 켜진 에이전트 Dots 부터 GPT-6.1 Sol, ChatGPT Space, Codex, 새 요금제까지 무엇을 누가 언제 쓸 수 있는지 한 번에 봅니다.

4분 분량

업계 동향 · 에이전트

OpenAI Dots 정리, 늘 켜져 있는 ChatGPT 에이전트는 무엇이 다른가

OpenAI 가 DevDay 에서 공개한 Dots 는 자기 클라우드 컴퓨터를 가진 채 ChatGPT·Slack·Teams 에서 늘 대기하며 일을 이어 가는 에이전트입니다. 무엇을 맡길 수 있는지, 누가 쓸 수 있는지, 권한과 승인은 어떻게 다루는지 정리했습니다.

7분 분량

업계 동향

GPT-6.1 Sol 과 Ultrafast 정리, Astra 에 가까운 성능을 5분의 1 가격에

OpenAI 가 DevDay 에서 GPT-6.1 Sol 을 공개했습니다. 가격은 GPT-6 Sol 과 같은데 코딩, 컴퓨터 사용, 문서 작업에서 GPT-6 Astra 에 가까운 점수를 냈습니다. 속도를 최대 8배 올리는 Ultrafast 와 함께, 무엇이 달라졌고 어떤 모델을 언제 쓰면 좋은지 정리했습니다.

6분 분량

업계 동향

ChatGPT Pro 500 출시, 200달러 Pro 는 무엇이 바뀌나

OpenAI 가 DevDay 에서 월 500달러 Pro 500 을 내놓고 200달러 Pro 의 Codex·Work 사용량은 줄이기로 했습니다. 새 요금제 구성과 기존 가입자 일정, ChatGPT 요금제를 다른 앱에서 쓰는 방법을 정리했습니다.

6분 분량

업계 동향 · 에이전트

ChatGPT Space 와 Pages, 팀과 에이전트가 같은 문서에서 일하는 법

OpenAI 가 DevDay 에서 ChatGPT 안의 협업 공간 Space 와 새 문서 형식 Pages 를 공개했습니다. 무엇을 할 수 있는지, 지금 쓸 수 있는 것과 곧 나올 것, 팀 작업과 Slack·Teams 연동, 권한과 개인정보까지 정리했습니다.

7분 분량

업계 동향 · 에이전트

노트북을 덮어도 일하는 Codex, DevDay 2026 업데이트 정리

OpenAI 가 DevDay 2026 에서 Codex 를 크게 손봤습니다. 팀이 함께 쓰는 클라우드 개발 환경, 음성과 에이전트 목록이 들어간 CLI, 데스크톱 앱의 코드 리뷰, GitHub 저장소를 훑는 Codex Security Cloud 까지 무엇이 바뀌었고 누가 쓸 수 있는지 정리했습니다.

8분 분량

업계 동향 · 에이전트

OpenAI 가 내놓은 결정 모델 Decisions API, Jev 와 나란히 보기

OpenAI 가 DevDay 에서 Luna 기반 Decisions API 를 제한 프리뷰로 공개했습니다. 정해 둔 보기 가운데 하나를 빠르게 고르고 이미지도 받습니다. 공개된 내용과 첫 비교 테스트, Jev 와 다른 점, 아직 발표되지 않은 것을 정리했습니다.

5분 분량

업계 동향 · 에이전트

Jev 활용 가이드, LLM 비용은 줄이고 3D 캐릭터 반응은 빠르게

TypeSafe 의 Jev 는 정해 둔 보기 가운데 하나를 0.5초 안에 고르는 결정 모델입니다. LLM 비용을 줄이는 라우터, 3D 캐릭터의 빠른 반응, 가드레일로 쓰는 방법과 한계를 도식과 함께 정리했습니다.

10분 분량

업계 동향 · 에이전트

Sonnet 5.5 가 Opus 를 앞선 날, 모델은 이제 어떻게 고를까

Claude Sonnet 5.5 가 Opus 5.5 의 절반 가격으로 한 벤치마크에서 Opus 를 앞섰습니다. 그런데 설정에 따라서는 작업 하나에 드는 돈이 오히려 더 많습니다. 발표된 숫자와 독립 측정을 나란히 놓고 모델 고르는 순서를 정리했습니다.

5분 분량

업계 동향 · 에이전트

GPT-6 Astra 와 Unity, 3D 작업에서 달라지는 것들

OpenAI 의 새 모델은 Unity 씬을 고치고 직접 플레이해 본 뒤 깨진 곳을 다시 고칩니다. 공개된 사례가 보여 주는 것과 성과가 나온 이유, 우리 팀이 따라 해 보려면 무엇부터 준비할지 정리했습니다.

5분 분량