아티클 목록으로
AI 에이전트

OpenAI의 ‘모두를 위한 AI 에이전트’, 사람들은 신뢰할까

약 3분 소요

들어가며

현재 많은 사람에게 AI는 질문을 입력하고 답변을 받는 창에 가깝다. OpenAI가 추진하는 다음 단계는 AI를 이메일, Slack, Notion, Figma 같은 도구에 연결해 정보를 읽고 애플리케이션을 호출하며 여러 단계의 업무를 직접 수행하게 만드는 것이다. 이 과정에서 가장 현실적인 질문이 나온다. 사용자는 자신의 디지털 생활을 어느 정도까지 대규모 언어 모델에 맡길 수 있을까.

최근 공개된 ChatGPT Work는 AI 에이전트를 소프트웨어 개발 영역 밖으로 확장하려는 제품이다. 월 20달러로 제공되며 재무, 투자, 운영, 의료 등 컴퓨터 중심의 직군을 겨냥한다. 단순히 답변이나 초안을 만드는 대신 정기 보고서, 스프레드시트 기반 계획, 데이터 분석, 여러 시스템 간 조정 같은 다단계 작업을 끝내는 것이 목표다.

핵심 포인트

  • Codex에서 범용 업무 에이전트로 확장한다. Work는 코딩 에이전트 Codex에서 출발했다. OpenAI는 비개발자가 이해하기 어려운 코드 용어와 개발자용 화면을 줄이며 커뮤니케이션·재무팀도 사용할 수 있도록 개선했다.
  • 에이전트에는 모델을 감싸는 소프트웨어가 필요하다. 이른바 하니스는 모델이 어떤 데이터를 보고 어떤 도구를 사용할지, 장기 작업을 어떻게 진행하고 결과를 어떻게 보여줄지를 결정한다.
  • 대중에게는 명확한 사용 경로가 필요하다. 개발자는 명령줄에서 여러 기능을 조합할 수 있지만, 일반 사용자는 버튼, 프로젝트 선택, 플러그인 같은 눈에 보이는 입구가 필요하다. OpenAI는 초기 단계에서 기능을 쉽게 발견하게 만드는 일이 중요하다고 본다.
  • 내부 활용과 외부 채택 사이에는 큰 차이가 있다. OpenAI가 지원한 연구에 따르면 6월 OpenAI 직원의 98%가 Codex를 사용했지만, 조직 구독자의 사용률은 17%, 개인 구독자는 1% 미만이었다.
  • 더 많은 맥락은 더 큰 위험을 뜻한다. 에이전트가 사적인 대화와 업무 기록을 읽으면 결과는 정교해질 수 있지만, 잘못된 정보 공유나 의도하지 않은 행동도 가능해진다. 세밀한 권한과 사용자 확인 절차가 필수적이다.

의미와 영향

AI 에이전트 확대는 OpenAI의 제품 전략이자 수익 전략이다. 더 오래 복잡한 작업을 수행하는 에이전트는 더 많은 모델 연산을 사용한다. 그러나 사용자가 계속 비용을 지불하려면 단순한 신기함을 넘어 실제 업무 성과와 시간 절감 효과를 체감해야 한다. 개발자 외 직군으로 시장을 넓히는 일은 대규모 학습 및 컴퓨팅 투자를 정당화하려는 AI 업계 전체에도 중요하다.

경쟁 구도는 모델 기업만으로 형성되지 않는다. 법률이나 영업처럼 특정 산업에 집중하는 기업들은 상황에 따라 가장 적합한 모델을 선택하는 방식으로 고객을 확보하고 있다. 이들은 산업별 지식, 고객 관계, 기존 업무 시스템과의 연결을 강점으로 삼을 수 있다.

결국 승부처는 가장 강력한 모델 하나가 아닐 수 있다. 서로 단절되고 오래된 디지털 도구를 연결하면서도, AI가 무엇을 읽고 어떤 행동을 하는지 사용자가 이해하고 중단할 수 있어야 한다. 버튼, 미리보기, 권한 설정, 확인 절차는 자동화의 마법을 약화시키는 것처럼 보이지만 신뢰를 형성하는 현실적인 장치다. OpenAI가 사용 편의성과 통제, 개인정보 문제를 해결하지 못한다면 에이전트는 전문가의 강력한 도구에 머물 가능성이 크다.

출처: TechCrunch AI

댓글

로그인 상태 확인 중…

댓글 불러오는 중…

관련 게시물

CCTest · Blog
Apodex 1.1, 추론을 넘어 복잡한 업무를 지속 수행하는 에이전트
AI 에이전트
cctest.ai
AI 에이전트

Apodex 1.1, 추론을 넘어 복잡한 업무를 지속 수행하는 에이전트

Apodex 1.1은 답변 생성에 그치지 않고 파일·검색·코드 환경에서 장기 작업을 수행하고 검증 가능한 결과를 내는 것을 목표로 한다. 환경 확장과 비동기 다중 에이전트 협업을 결합했으며 35B 파라미터 Mini 모델도 제공한다.

더 보기
CCTest · Blog
개별 지능에서 시스템 지능으로: LLM 에이전트에 필요한 Graph Engineering
AI 에이전트
cctest.ai
AI 에이전트

개별 지능에서 시스템 지능으로: LLM 에이전트에 필요한 Graph Engineering

서로 다른 전문성, 병렬 실행, 독립 검증, 지속적인 상태 관리가 필요한 작업에서는 단일 LLM 에이전트를 강화하는 것만으로 충분하지 않습니다. Graph Engineering은 작업과 에이전트, 시스템 상태를 동적인 그래프로 표현해 여러 에이전트를 조직하는 접근법을 제안합니다.

더 보기
CCTest · Blog
AgentMercury, 검증 가능한 비즈니스 환경을 대규모로 합성하다
AI 에이전트
cctest.ai
AI 에이전트

AgentMercury, 검증 가능한 비즈니스 환경을 대규모로 합성하다

AgentMercury는 특정 작업이나 벤치마크에 맞춘 시뮬레이션 대신, 지속적으로 변화하는 비즈니스 세계를 생성하는 프레임워크입니다. 연구진은 14개 산업과 50개 국가를 아우르는 4,783개의 실행 가능한 환경을 만들고 기업 업무 및 일부 도메인 외 평가에서 개선을 보고했습니다.

더 보기