AI에게 일을 오래 맡길수록 사람이 일일이 시키는 일은 줄어듭니다. 대신 사람이 미리 정해 둘 일은 세 가지로 모이고, 하나하나는 더 촘촘해집니다. 어디까지 들어가도 되는지(허락), 어떤 프로그램이 일하는지(신원), 언제 끝난 것으로 볼지(완료 기준)입니다. OpenAI가 8월 말부터 9월 말까지 내놓은 기술 변경을 네 흐름으로 묶어 보면 이 방향이 뚜렷하게 보입니다.
이 글은 OpenAI API 변경 기록과 개발자 문서, 개발자 블로그(2026년 10월 4일 확인)를 바탕으로 정리했습니다. 변경 하나하나는 문서에 적힌 사실이고, 네 흐름으로 묶어 세 가지 몫으로 이은 것은 제 해석입니다. 넷째 흐름의 근거인 개발자 블로그 글은 게시일이 표기되어 있지 않아, 이 한 달 안의 글인지는 확인하지 못했습니다.
첫째, AI가 질문에 답하는 대신 오래 혼자 일합니다
9월 3일 OpenAI는 GPT-6 Astra를 내놓으면서, 이 모델로 오래 걸리는 작업을 다루는 장치를 함께 추가했습니다. 도구 호출(AI가 외부 기능을 써 달라고 요청하는 것)의 결과를 기다리지 않고 진행하는 기능, 대화 중간에 얼마나 깊이 생각할지를 바꾸는 기능, 그리고 작업 중 방향 수정입니다. 문서의 예를 보면, 앱 개발 계획을 짜 달라고 맡겨 둔 사이에 “혼자서 2주 안에 끝낼 범위로”라는 조건을 보내면 응답을 처음부터 다시 만들지 않고 그 조건을 반영해 이어 갑니다.
9월 10일에는 Agents API가 공개 베타로 나왔습니다. 코드를 실행하고 파일을 고치고 외부 서비스에 연결해 결과물을 만드는 에이전트를 API로 띄우는 서비스입니다. 문서는 세션 관리, 작업 조율, 맥락 압축(긴 대화를 줄여 이어 가게 하는 것), 중단 후 복구를 OpenAI가 맡는다고 설명합니다. 9월 29일에는 여기에 브라우저 조작 기능이 더해져, 에이전트가 OpenAI가 운영하는 브라우저에서 웹사이트 화면을 보며 다음 행동을 정합니다.
작업 중 방향 수정은 사람이 중간에 들여다볼 때만 쓸모가 있습니다. 몇 시간씩 혼자 가는 일이라면, 결과가 나온 뒤에만 보는 것으로는 부족하고 언제 들여다볼지와 무엇이 되면 끝인지를 미리 정해 두어야 합니다. 이 글에서는 이 둘을 묶어 완료 기준이라고 부릅니다. 그래서 첫째 흐름은 완료 기준으로 이어집니다.
둘째, 그래서 어디까지 허락할지가 설계의 중심이 됩니다
9월 29일 브라우저 조작 문서는 사람이 끼어들 자리를 구체적으로 정해 두었습니다. 에이전트가 새로운 웹사이트 주소에 들어가려 할 때마다 사용자의 승인을 받아야 하고, 공개 웹사이트도 예외가 아닙니다. 미리 허용 목록을 만들어 두는 방식이 아니라 사이트마다 묻는 방식입니다.
로그인도 앱이 맡습니다. 에이전트가 로그인이 필요하다고 요청하면 앱이 입력 화면을 띄우고, 사용자가 넣은 값은 전용 경로로만 전달됩니다. 문서는 이 값이 모델 입력에 들어가지 않고 세션 기록에서도 빠진다고 적어 두었습니다. 웹페이지에는 AI가 읽고 따를 수 있는 문장을 몰래 숨겨 둘 수 있습니다. 그래서 문서는 웹사이트 내용을 신뢰하지 않는 정보로 다루며, 그 내용이 사용자의 지시를 덮어쓸 수 없다고 명시합니다. 결제나 삭제처럼 결과가 큰 행동은 승인만 믿지 말고, 브라우저가 아예 그런 일을 할 수 없는 곳에만 접근하게 막거나, OpenAI가 운영하는 브라우저 대신 직접 운영하는 브라우저 환경을 쓰라고 권합니다.
이제 승인은 AI 회사가 알아서 해 주는 기능이 아니라, 서비스를 만드는 쪽이 화면으로 설계해야 하는 일이 됐습니다. 어디에, 왜 들어가려는지를 사용자가 읽고 판단할 수 있게 보여 주는 것까지가 제품의 몫입니다. 둘째 흐름은 허락으로 이어집니다.
셋째, 어떤 프로그램이 일하는지 확인하는 열쇠 관리가 촘촘해집니다
AI 프로그램은 API 키라는 열쇠로 OpenAI에 접속합니다. 일하는 에이전트가 늘면 열쇠도 늘고, 새어 나간 열쇠의 위험도 커집니다. 8월 29일에는 상호 TLS와 X.509 워크로드 신원 연동이 정식으로 나왔습니다. 쉽게 말하면 비밀번호 같은 키를 주고받는 대신, 기계가 인증서로 자기 신원을 증명하는 방식입니다.
9월 10일부터는 프로젝트 API 키를 만들 때 만료일을 정할 수 있고, 관리자는 키의 최대 수명을 강제할 수 있습니다. 운영 모범 사례 문서는 만료일을 정하고 정기적으로 교체하라고 강하게 권하며, 교체 순서도 적어 두었습니다. 새 키를 먼저 만들어 프로그램에 넣고, 잘 돌아가는지 확인한 뒤 옛 키를 폐기합니다. 9월 15일에는 어떤 종류의 키를 새로 만들 수 있는지도 관리자가 정할 수 있게 됐습니다. 사람 계정에 묶이지 않는 서비스 계정 키만 허용하거나, 사용자 소유 키만 허용하거나, 새 키 생성을 아예 막을 수 있습니다.
사무실 출입증에 만료일을 찍고, 어떤 출입증을 새로 발급할 수 있는지 정하는 것과 비슷합니다. 다만 출입증은 잃어버리면 알아채기 쉽지만, API 키는 글자 몇 줄이라 어딘가에 복사돼 남아 있어도 알기 어렵습니다. 그래서 기한과 발급 권한을 미리 정해 두는 쪽이 더 중요합니다. 셋째 흐름은 신원으로 이어집니다.
넷째, 똑똑해진 AI에게는 지시를 덜어냅니다
앞의 세 흐름이 사람이 더 챙겨야 할 것을 말한다면, 넷째 흐름은 덜어낼 것을 말합니다. OpenAI 개발자 블로그의 ‘Rethinking skills and prompts for GPT-6 Astra’ 글은 GPT-6 Astra에게는 예전 지시를 줄이라고 권합니다. GPT-6 Astra는 변경 기록에 따르면 9월 3일 나온, OpenAI의 가장 성능 높은 모델입니다. 예전 모델에는 테스트를 돌리고 결과를 확인하라고 일일이 독려해야 했지만, GPT-6 Astra는 스스로 하므로 같은 지시가 불필요한 테스트를 부른다는 것입니다.
글은 몇 가지를 구체적으로 권합니다. 스킬(자주 하는 작업 절차를 묶어 AI가 꺼내 쓰게 한 것)의 설명에서 막연한 발동 조건을 빼고, 언제 쓰는지를 좁혀 적습니다. 원문의 예로 보면, 데이터베이스와 관련된 일 전반에 쓴다는 설명 대신, 마이그레이션(데이터 구조 변경)을 추가하거나 바꿀 때 또는 그 배포를 검토할 때 쓴다고 좁히는 식입니다. 프로젝트 안내 문서(AGENTS.md)는 매번 다 읽게 하지 말고 필요할 때 어느 문서를 볼지만 알려 줍니다. 그리고 무엇이 끝인지 완료 기준은 먼저 정하라고 합니다.
일일이 시키는 지시가 빠진 자리를 완료 기준이 채웁니다. 넷째 흐름도 완료 기준으로 이어집니다.
세 가지 몫마다 오늘 해 볼 일이 있습니다
네 흐름을 이으면 사람의 몫은 세 가지로 남습니다. 허락은 둘째 흐름에서, 신원은 셋째 흐름에서, 완료 기준은 첫째와 넷째 흐름에서 나옵니다. AI를 쓰는 쪽이든 만드는 쪽이든, 몫마다 오늘 해 볼 일을 하나씩 적어 보면 이렇습니다.
허락: 사이트 접근이나 권한 승인 요청을 받으면 주소와 이유부터 읽습니다. 서비스를 만드는 쪽이라면 승인 화면에 그 두 가지가 보이게 합니다.
신원: API로 서비스를 만드는 쪽이라면, OpenAI 플랫폼의 API 키 관리 화면에서 지금 쓰는 키를 확인합니다. 만료일이 없는 키는 만료일을 넣은 새 키로 바꾸고, 새 키가 잘 돌아가는 것을 확인한 뒤 옛 키를 폐기합니다.
완료 기준: AI에게 오래 맡기는 일에는 무엇이 되면 끝인지 한 줄을 먼저 적고, 중간에 확인할 때를 정해 둡니다. 예를 들면 ‘경쟁 서비스 세 곳의 요금을 표 하나로 정리하고, 표의 출처 링크가 모두 열리면 끝’ 같은 한 줄입니다. 예전 모델에 맞춰 써 둔 맞춤 지시가 있다면 막연한 조건과 독려 문구를 덜어내고 그 한 줄로 바꿉니다.
마치며
이번 한 달의 변화는 ‘AI가 더 많이 한다’가 아니라 ‘사람이 정할 일이 더 분명해졌다’였습니다. 일을 오래 맡길수록, 허락과 신원과 완료 기준을 먼저 적어 두는 쪽이 AI의 능력을 제대로 쓰게 됩니다.
오늘 하나만 한다면 완료 기준이 가장 바로 할 수 있습니다. 지금 AI에게 맡기고 있거나 맡기려는 일 하나를 골라, 무엇이 되면 끝인지를 한 줄로 적어 보시길 권합니다.
이 글은 AI의 도움을 받아 작성했습니다.
참고 자료
- OpenAI API 변경 기록: https://developers.openai.com/api/docs/changelog
- Agents API 개요: https://developers.openai.com/api/docs/guides/agents-api/overview
- 작업 중 방향 수정(Mid-turn steering): https://developers.openai.com/api/docs/guides/steering
- 브라우저 조작(Computer use): https://developers.openai.com/api/docs/guides/agents-api/tools/computer-use
- 운영 모범 사례(API 키): https://developers.openai.com/api/docs/guides/production-best-practices
- Rethinking skills and prompts for GPT-6 Astra: https://developers.openai.com/blog/rethinking-skills-and-prompts-for-gpt-6-astra
