8월, 2026의 게시물 표시

EP3-보고 듣고 말하는 ChatGPT: 멀티모달 경험의 확장

보고 듣고 말하는 ChatGPT: 멀티모달 경험의 확장 EP-02에서 살펴본 변화는 ChatGPT를 얼마나 자주, 어떤 조건으로 사용할지 선택하게 됐다는 점이었습니다. 다음 변화는 질문을 입력하는 방식 자체에 관한 것이었습니다. 사용자는 더 이상 모든 내용을 문장으로 옮겨 적지 않아도 대화를 시작할 수 있게 됐습니다. 사진을 보여주고 묻거나, 말로 질문하고 음성으로 답을 들을 수 있게 됐기 때문입니다. OpenAI는 2023년 9월 25일 ChatGPT가 이미지와 음성을 다루는 경험으로 확장된다고 발표했습니다. 당시 발표는 이미지 기반 대화와 음성 대화를 소개했지만, 모든 기능이 모든 사용자에게 동시에 제공된 것은 아니며 단계적으로 제공된다고 안내했습니다. 따라서 당시 발표된 기능과 현재 이용 가능한 기능의 범위·조건은 구분해서 확인해야 합니다. ChatGPT can now see, hear, and speak 중요한 변화는 기능의 개수가 아닙니다. 사람과 ChatGPT 사이에 오가는 자료의 형태가 텍스트에만 머물지 않게 됐다는 점입니다. 이미지를 보여주고 묻는 경험 텍스트 대화만 가능할 때는 사진이나 문서의 내용을 먼저 글로 설명해야 했습니다. 이미지 입력이 가능해지면서 사용자는 대상 자체를 대화에 가져올 수 있게 됐습니다. 여행지에서 본 표지판의 뜻을 묻거나, 집 안 물건의 사용법을 확인하거나, 손으로 적은 메모를 정리해 달라고 요청하는 식입니다. 개인 업무에서도 활용 장면은 달라집니다. 회의 자료의 화면 캡처를 보여주고 핵심 내용을 묻거나, 표와 도표에서 확인할 항목을 정리하는 데 도움을 받을 수 있습니다. 질문을 만들기 위해 자료를 다시 옮겨 적는 단계가 줄어든다는 것이 체감되는 변화입니다. 다만 이미지의 내용을 정확히 인식하거나 업무 판단에 필요한 해석을 완전히 대신한다고 보기는 어렵습니다. 이미지를 올렸다고 해서 모든 세부 내용을 정확하게 읽거나 상황을 완전히 이해한다고 볼 수는 없습니다. 작은 글씨, 흐릿한 사진, 복잡한 표는 틀리게 해석될 수 있...

EP5-개인 작업 공간으로의 확장: 프로젝트·작업 관리·에이전트

개인 작업 공간으로의 확장: 프로젝트·작업 관리·에이전트 EP-04에서 살펴본 변화는 웹을 검색하고 파일을 읽고 여러 자료를 조사하는 과정이 대화 안으로 들어왔다는 점이었습니다. 하지만 조사와 정리가 며칠 또는 몇 주 동안 이어지면 새로운 문제가 생깁니다. 이전 대화와 파일을 다시 찾고, 작업 목적과 지침을 유지하고, 해야 할 일을 잊지 않으면서 결과를 이어 가야 하는 문제입니다. 이 단계에서 ChatGPT는 질문에 답하거나 자료를 정리하는 도구를 넘어 개인 작업의 맥락과 실행을 관리하는 공간으로 확장됩니다. 다만 기능이 많아졌다는 사실보다 중요한 것은 각 기능이 해결하는 문제가 서로 다르다는 점입니다. 프로젝트로 맥락을 묶기 OpenAI Help Center는 Projects 를 관련 대화, 파일, 지침을 한 공간에 모아 작업 맥락을 유지하는 기능으로 안내합니다. Projects in ChatGPT 예를 들어 자격증 공부, 개인 블로그 연재, 여행 계획처럼 여러 번의 대화와 자료가 필요한 일을 하나의 프로젝트로 묶을 수 있습니다. 매번 처음부터 배경을 설명하거나 파일을 다시 찾는 대신, 같은 주제에 필요한 자료와 지침을 모아 두는 방식입니다. Projects 의 가치는 대화를 오래 저장하는 데만 있지 않습니다. 어떤 결과를 만들고 있는지, 어떤 자료를 기준으로 삼는지, 답변의 형식과 주의사항은 무엇인지 맥락을 유지하는 데 있습니다. 반대로 모든 자료를 무조건 넣는 것이 좋은 것은 아닙니다. 프로젝트에 포함할 파일은 목적에 필요한지, 공유해도 되는지, 최신 버전인지 먼저 확인해야 합니다. 작업 관리로 반복을 다루기 한 번의 답변으로 끝나지 않는 일에는 시간 조건도 필요합니다. 매주 같은 내용을 확인하거나 특정 시점에 알림을 받고, 정해 둔 작업을 다시 실행해야 하는 경우입니다. OpenAI Help Center는 Tasks 를 예약 또는 반복 실행과 완료 알림을 지원하는 기능으로 안내합니다. Tasks in ChatGPT 개인 사용자는 정기적인 학습 알림, 주...

찾고 읽고 정리하는 도구: 검색·파일·리서치 활용

  찾고 읽고 정리하는 도구: 검색·파일·리서치 활용 EP-03에서 살펴본 변화는 사진을 보여주고 말로 질문하는 등 대화에 가져오는 자료의 형태가 넓어졌다는 점이었습니다. 다음 단계에서는 대화의 대상이 사용자가 가진 자료만이 아니라 웹의 최신 정보와 여러 문서로 확장됩니다. ChatGPT가 질문에 답하는 도구를 넘어, 자료를 찾고 읽고 정리하는 작업 흐름을 대화 안에서 이어 가는 방식으로 쓰이기 시작한 것입니다. OpenAI는 2024년 10월 31일 ChatGPT search를 발표했습니다. 당시 발표는 웹 정보를 찾아 답변하고 관련 출처 링크를 제공하는 방식으로 검색 경험을 소개했습니다. 이는 모든 사용자에게 같은 날 같은 조건으로 기능이 제공되었다는 뜻은 아닙니다. Introducing ChatGPT search 이 변화의 핵심은 검색창이 대화창으로 바뀌었다는 단순한 설명에 있지 않습니다. 사용자는 질문의 맥락을 설명하고, 찾은 정보에 이어서 다시 묻고, 여러 자료를 하나의 흐름 안에서 정리할 수 있게 됐습니다. 자료를 찾는 단계와 그 자료를 이해하는 단계가 하나의 대화에서 이어질 수 있다는 점이 개인의 조사 방식에 영향을 줬습니다. 검색으로 최신 정보를 확인하기 예를 들어 여행 계획을 세우며 운영 시간이나 최근 변경 사항을 묻거나, 어떤 주제의 최근 동향을 출처와 함께 파악하려는 상황을 생각해 볼 수 있습니다. 검색은 비교적 범위가 좁은 질문에 대해 웹 정보를 확인하고, 결과에 대해 후속 질문을 이어 가는 데 유용할 수 있습니다. 하지만 검색 결과에 링크가 있다고 해서 내용을 그대로 믿어도 된다는 뜻은 아닙니다. 출처가 실제로 질문에 답하는 자료인지, 작성일과 기준 시점이 적절한지, 원문이 결과의 요약과 같은 의미인지 확인해야 합니다. 가격, 일정, 법률·의료 정보처럼 변동이 크거나 중요한 판단에 영향을 주는 내용은 공식 원문을 직접 확인하는 편이 안전합니다. 검색 기능을 사용하더라도 최신성·정확성이 자동으로 보장되는 것은 아닙니다. 검색은 최신...

EP6-현재의 개인 활용 방식: 일상과 업무를 연결하는 사용 기준

  현재의 개인 활용 방식: 일상과 업무를 연결하는 사용 기준 ChatGPT의 변화는 대화형 AI의 대중화에서 시작했습니다. 이후 유료 서비스와 모델 선택이 생겼고, 이미지와 음성을 보고 듣는 방식이 더해졌습니다. 웹 검색과 파일·리서치 기능은 자료를 찾고 정리하는 흐름을 대화 안으로 가져왔고, 프로젝트·작업 관리·에이전트는 한 번의 질문을 넘어 지속 작업을 지원하는 방향으로 확장됐습니다. 이 흐름을 기능 목록으로만 보면 선택지는 끝없이 늘어납니다. 하지만 개인 사용자가 실제로 답해야 할 질문은 더 단순합니다. 지금 하려는 일은 무엇이고, 어떤 자료가 필요하며, 결과를 어디까지 직접 확인할 것인가입니다. 기능보다 목적을 먼저 정하면 필요한 사용 방식도 좁혀집니다. 일상에서는 생각을 정리하는 도구로 일상에서 ChatGPT는 계획을 세우거나, 낯선 개념을 쉽게 설명받거나, 떠오른 아이디어를 정리하는 데 활용할 수 있습니다. 짧은 문장을 다듬는 일에는 텍스트 대화가 충분할 수 있고, 사진 속 표지판이나 물건을 설명받고 싶을 때는 이미지 입력이 편할 수 있습니다. 이동 중 아이디어를 남기거나 발음·표현을 연습할 때는 음성 대화가 맞을 수도 있습니다. 중요한 것은 새로운 입력 방식을 반드시 사용해야 한다는 뜻이 아니라 작업에 맞는 방식을 고르는 것입니다. 사진을 올릴 때는 불필요한 개인정보가 포함되지 않았는지 확인하고, 음성으로 말할 때는 주변에 내용이 노출되어도 괜찮은지 살펴야 합니다. 이미지나 음성으로 얻은 설명도 중요한 사실이라면 원자료와 대조해야 합니다. 예를 들어 여행 계획을 세울 때 ChatGPT에 일정 초안을 요청할 수 있지만, 운영 시간과 예약 조건은 공식 사이트에서 다시 확인해야 합니다. 학습에 활용할 때도 설명을 이해를 돕는 출발점으로 사용하고, 시험이나 과제의 기준 자료와 대조하는 과정이 필요합니다. 개인 업무에서는 작업 단계에 맞춰 나누어 사용하기 개인 업무는 일상처럼 하나의 장면으로 끝나지 않습니다. 목적을 명확히 정하는 것부터 시작해, ...

유료 서비스와 모델 선택: 개인의 활용 범위는 어떻게 넓어졌나

  유료 서비스와 모델 선택: 개인의 활용 범위는 어떻게 넓어졌나 EP-01에서 살펴본 초기 ChatGPT 경험의 핵심은 자신의 말로 질문하고, 답변을 이어서 수정할 수 있었다는 점입니다. 이 대화 방식에 익숙해진 사용자는 곧 다른 선택을 마주하게 됐습니다. 더 자주 사용하려면 어떤 접근 방식을 택해야 하는지, 작업에 따라 어떤 모델이나 모드를 사용해야 하는지 판단해야 했습니다. 처음에는 ChatGPT를 가끔 시험해 보는 도구로 쓸 수 있었습니다. 하지만 글을 여러 번 고치거나, 학습 내용을 정리하거나, 자료를 비교하는 등 반복 작업에 사용하려면 접근 안정성, 응답 속도, 필요한 기능과 결과를 검토할 시간까지 함께 고려해야 했습니다. 무료와 유료 중 하나를 고르는 문제는 사용 목적과 기대 수준을 정하는 문제로 넓어졌습니다. ChatGPT Plus가 만든 유료 접근 OpenAI는 2023년 2월 1일 ChatGPT Plus를 월 20달러의 구독 플랜으로 발표했습니다. 당시 발표에서 Plus는 혼잡 시간대의 일반적인 접근, 더 빠른 응답, 새로운 기능과 개선 사항에 대한 우선 접근을 혜택으로 제시했습니다. 발표 본문은 미국과 전 세계 고객에게 제공된다고 안내하고, 각주에서는 미국 외 고객으로의 접근 확대가 2023년 2월 10일 이루어졌다고 설명합니다. Introducing ChatGPT Plus 이 발표의 의미는 무료 연구 미리보기로 시작한 서비스에 개인이 비용을 지불하고 지속적으로 이용할 경로가 생겼다는 데 있습니다. 사용자는 단순히 “써 볼 수 있는가”만이 아니라, 자신의 사용 빈도와 필요한 접근 조건을 기준으로 서비스를 선택하기 시작했습니다. 다만 위 내용은 출시 당시의 조건입니다. 가격, 제공 지역, 기능, 사용량 제한은 이후 변경될 수 있으며 현재 조건을 과거 발표만으로 판단할 수 없습니다. 현재 조건은 발행 시점에 공식 플랜 안내와 ChatGPT Release Notes 를 별도로 확인해야 합니다. 이 글에서 현재 조건을 언급할 때는 공통 출처...

ChatGPT의 등장과 대화형 AI의 대중화

  ChatGPT의 등장과 대화형 AI의 대중화 이 글에서 말하는 ‘대중화’는 이용자 수나 보급률이 늘었다는 뜻이 아닙니다. 2022년 ChatGPT 공개를 계기로, 전문 도구나 별도의 명령어 문법을 먼저 익히지 않은 개인도 자연어로 AI를 질문하고 답을 이어 가는 경험에 접근할 수 있게 된 변화를 뜻합니다. 이 글은 그 출발점인 2022년 11월 공개와 초기 대화 경험을 다룹니다. AI를 활용한다고 하면, 예전에는 전문 프로그램을 배우거나 정해진 검색어를 고르는 장면을 떠올리기 쉬웠습니다. ChatGPT의 초창기 경험은 조금 달랐습니다. 사용자는 자신의 말로 질문하고, 답이 충분하지 않으면 조건을 더하고, 표현을 바꾸고, 다시 물을 수 있었습니다. 이 방식은 AI를 사용하기 위해 먼저 전문 도구나 명령어의 문법을 익혀야 한다는 부담을 낮추는 출발점이 됐습니다. 글의 초안을 만들고, 내용을 짧게 요약하고, 떠오른 아이디어를 정리하는 작업을 대화의 형태로 시도할 수 있었기 때문입니다. 여기에 무료로 이용할 수 있는 연구 미리보기라는 공개 방식이 더해지면서, 일반 개인도 AI의 가능성과 한계를 직접 시험해 볼 수 있는 기회를 넓혔습니다. 따라서 여기서 ‘대중화의 출발점’이라고 부르는 근거는 숫자에 있지 않습니다. 자연어 입력, 무료 연구 미리보기, 전문 도구 없이 접근할 수 있는 대화형 인터페이스가 결합해 개인의 첫 접근 장벽을 낮췄다는 데 있습니다. 이후의 유료 서비스와 기능 확장은 이 초기 경험을 바탕으로 전개되지만, 그 내용은 다음 회차부터 별도로 살펴봅니다. 2022년 11월 30일, 연구 미리보기로 공개된 ChatGPT OpenAI는 2022년 11월 30일 ChatGPT를 공개했습니다. 당시 안내는 이를 무료로 사용할 수 있는 연구 미리보기로 소개했습니다. 지금의 기능과 이용 조건을 모두 갖춘 완성형 서비스를 선언한 것이 아니라, 사용자 피드백을 받기 위한 연구 미리보기로 제시되었습니다. OpenAI 공식 발표 이 시점의 ChatGPT를 이해할 ...

컨덕터 빌드 앱 : 시작 하기

Conductor가 무엇인지, 그리고 문서에서 어디서부터 시작해야 하는지 알아보세요. Conductor를 사용하면 Claude Code, Codex, Cursor 및 OpenCode를 병렬로 실행할 수 있습니다. 각 작업에는 고유한 작업 공간, 분기, 파일, 터미널, 차이점 비교 및 ​​검토 경로가 할당됩니다. 작업이 완료되면 Conductor는 차이점을 검토하고, 풀 리퀘스트를 열고, 병합하고, 작업 공간을 보관하는 데 도움을 줍니다. 컨덕터를 소개합니다 시작하기 Conductor는 macOS에서 사용할 수 있습니다. 앱을 설치한 다음 Conductor가 Mac이 워크스페이스를 생성하고 에이전트를 실행할 준비가 되었는지 확인하도록 하십시오. Mac용 다운로드 Conductor 다운로드 버튼을 누르 D 거나 클릭하세요 . Conductor 앱을 응용 프로그램 폴더로 드래그하세요. 개방형 도체. 정보 : Conductor는 아직 Windows 또는 Linux에서 사용할 수 없습니다. 여기에서 등록하시면 준비되는 대로 알려드리겠습니다. 설정 확인 Conductor를 실행하면 필요한 도구와 자격 증명을 확인합니다. 누락된 항목이 있으면 Conductor가 설정 과정을 안내합니다. 지휘자는 다음 사항을 점검합니다: 터미널 환경에서 GitHub 인증을 확인하세요. 수동으로 확인하려면 다음 명령어를 실행하세요 gh auth status . Claude를 사용하려면 Claude 코드 로그인을 사용하세요. 수동으로 로그인하려면 다음 명령어를 실행하세요 claude /login . Codex를 사용하려면 Codex 로그인 화면이 필요합니다. 수동으로 로그인하려면 다음 명령어를 실행하세요 codex login . Cursor를 사용할 계획이라면 Cursor API 키를 입력하세요. Settings -> Harnesses -> 에 추가하세요 Cursor . Conductor를 사용하려면 GitHub와 하나 이상의 에이전트 제공업체가 필요합니다. 다음 단계