AI 비서, 어디까지 맡길까요? 잘하는 일과 맡기면 안 되는 일

AI 비서는 초안은 훌륭하게 쓰지만 결정은 서툴러요. 앞의 장점은 챙기고 뒤의 위험은 피하는 법을 알려 드릴게요.

  • AI 비서(ChatGPT, Gemini, Claude, Copilot과 이를 바탕으로 만든 앱)는 준비를 아주 잘해요. 문장 하나로 지출 기록하기, 리마인더 설정, 메시지나 견적서 초안 쓰기, 편지 요약하기.
  • 자신 있게 틀리기도 해요. 22개 공영방송이 참여한 2025년 연구에서 뉴스에 관한 AI 비서의 답변 중 45%에 적어도 하나의 중대한 문제가 있었어요.
  • 가장 중요한 규칙: AI가 준비하고, 내가 확인한다. 내 동의 없이 보내거나, 결제하거나, 저장되는 건 없어야 해요.
  • 건강, 법률, 투자 결정에서는 질문을 정리하는 데 쓰고, 결정은 맡기지 마세요.
  • 생활 속 잡무를 맡기기 전에 개인정보 질문 다섯 가지를 확인하고, 비밀번호, PIN, 전체 카드 번호는 절대 입력하지 마세요.

AI 비서란 정확히 무엇일까요?

요즘 AI 비서는 대규모 언어 모델 위에서 돌아가요. 데이터베이스에서 사실을 찾아보는 게 아니라, 학습한 내용을 바탕으로 지금까지의 글에 이어질 가장 그럴듯한 말을 한 단어씩 만들어 내요. 대부분은 쓸모 있고 매끄러운 답이 나와요. 가끔은 매끄럽지만 틀린 답이 나오는데, 이를 환각(hallucination)이라고 해요.

왜 그냥 “모르겠어요”라고 하지 않을까요? 2025년 9월 OpenAI와 조지아공대 연구진(Kalai 외)은 논문에서 모델을 어려운 시험 문제 앞의 학생에 빗대요. 불확실하다고 인정하는 대신 찍는 거예요. 학습과 벤치마크 채점이 솔직한 빈칸보다 자신 있는 답에 점수를 주기 때문이에요. 한 번의 버그가 아니라 이런 시스템을 만들고 평가하는 방식에서 나오는 문제예요.

그러니 두 가지를 구분하세요. AI 비서는 내가 준 글을 다루는 일에는 뛰어나요. 내 메모, 내 숫자, 내 초안이요. 눈앞에 없는 사실을 말하는 일에는 훨씬 덜 믿을 만해요.

얼마나 많은 사람이 이미 쓰고 있을까요?

미국 퓨리서치센터가 2026년 2월 성인 5,119명을 조사한 결과, 미국 성인의 약 절반(49%)이 AI 챗봇을 써요. 2024년의 3분의 1에서 늘었어요. 약 4분의 1은 매일 써요. 가장 흔한 용도는 정보 검색(42%)과, 직장인의 경우 업무(38%)였어요. 다섯 명 중 한 명(20%)은 의료 조언을 얻으려고 챗봇을 쓴다고 했어요.

사람들은 쓰면서 동시에 믿지 않아요. 같은 조사에서 미국인의 71%는 AI 사용이 늘면 개인정보가 덜 안전해질 거라고 했고, 더 안전해질 거라는 답은 3%뿐이었어요.

일상 속 AI 비서
49%AI 챗봇을 쓰는 미국 성인Pew Research Center, 2026
45%적어도 하나의 중대한 문제가 있었던 AI 비서의 뉴스 답변EBU and BBC, 2025
71%AI 때문에 개인정보가 덜 안전해질 거라고 보는 미국인Pew Research Center, 2026

AI 비서가 매일 잘하는 일

잘 쓰는 방법에는 공통된 패턴이 있어요. 사실은 내가 주고, 형식은 AI가 맞추고, 나는 한눈에 확인한다.

  • 문장 하나로 지출 기록. “점심 9,500원, 현금”이 금액, 항목, 계좌가 있는 한 줄이 돼요. 맞는지 바로 보여요. 사람들이 가장 잘 잊는 현금 지출에서 특히 중요해요(현금 지출 기록하는 법 참고).
  • 리마인더 설정. “매달 1일에 관리비 내라고 알려 줘”는 확인하기 쉬워요. 날짜, 반복, 끝.
  • 기억해 두기. “민재 신발 사이즈 270이라고 기억해 줘”는 내가 이미 아는 사실을 저장해 둬서, 뒤지지 않고 찾을 수 있게 해 줘요.
  • 초안 쓰기. 집주인에게 보낼 메시지, 입금이 늦은 거래처에 보내는 정중한 재촉, 64만 원짜리 주방 수리 견적서까지. AI 비서가 깔끔한 초안을 주면 나는 말투와 숫자를 고쳐요(휴대폰으로 견적서와 청구서 만들기 참고).
  • 요약과 쉬운 말로 바꾸기. 보험사에서 온 빽빽한 안내문이 분명한 세 줄이 돼요. 날짜와 금액은 원문을 옆에 두고 확인하세요.
  • 번역. 가족이나 해외 거래처에 보낼 짧은 메시지를 옮길 때요.

잘 못하는 일: 사실을 말하는 것

오류는 드물지 않고, 티도 나지 않아요. 맞는 답과 똑같이 자신 있는 말투로 나와요.

  • 뉴스. 유럽방송연맹(EBU)과 BBC의 News Integrity in AI Assistants 연구(2025년 10월)에서 18개국 22개 공영 미디어의 기자들이 ChatGPT, Copilot, Perplexity, Gemini 무료 버전의 답변 2,709개를 평가했어요. 45%에 적어도 하나의 중대한 문제가 있었고, 31%는 출처 문제, 20%는 지어내거나 오래된 내용 같은 정확성 문제가 있었어요.
  • 법률. 연구진(Dahl 외, 2024)이 미국 연방 법원 판례에 관해 확인 가능한 구체적인 질문을 던졌더니, 모델은 58%(GPT-4)에서 88%(Llama 2)까지 틀린 답을 했어요. Mata v. Avianca(2023) 사건에서 뉴욕 연방 판사는 ChatGPT가 지어낸 판례를 인용한 서면을 낸 변호사 두 명과 로펌에 5,000달러의 제재금을 부과했어요.
  • 건강. Nature Medicine에 실린 무작위 시험(Bean 외, 2026)에서 영국 성인 1,298명이 의료 상황 시나리오를 풀었어요. 모델만 단독으로 시험하면 94.9%에서 관련 질환을 짚어냈어요. 그런데 같은 모델을 쓴 사람들은 34.5% 미만에서만 관련 질환을 찾아냈고, 평소 쓰던 방법을 쓴 대조군보다 나을 게 없었어요. 문제는 대화에서 생겼어요. 사람들은 세부 사항을 빼먹었고, 모델의 맞는 제안은 묻혀 버렸어요.

실용적인 답은 두 가지를 저울질하는 거예요. 얼마나 중요한 일인지, 결과를 얼마나 쉽게 확인할 수 있는지요.

AI 비서에게 무엇을 맡길까요?
확인하기 쉬움확인하기 어려움중요도 낮음중요도 높음
맡기세요AI가 일하고 나는 훑어봐요문장 다듬기, 장보기 목록, 간단한 번역
탐색만, 결론은 말고처음 둘러보기엔 좋지만 판정용은 아니에요주말 나들이 아이디어, 표현의 유래, 주제 입문
준비시키고 확인하기AI가 초안을 쓰고, 저장 전에 모든 숫자를 확인해요85만 원짜리 견적서, 23,400원 지출, 청구서 납부일
결정은 내가전문가와 공식 자료로걱정되는 증상, 법적 분쟁, 저축을 어디에 투자할지
중요할수록, 확인하기 어려울수록 AI가 결정하는 몫은 줄어야 해요.

황금률: AI 비서가 준비하고, 내가 확인한다

보내고, 올리고, 저장하고, 결제하는 등 행동할 수 있는 비서는 말만 하는 비서보다 쓸모 있지만 더 위험해요. 널리 쓰이는 보안 기준인 OWASP의 LLM 애플리케이션 10대 위험에는 ‘과도한 권한(Excessive Agency)’이 들어 있어요. 권고는 사람이 중간에서 확인하는 구조를 두어, 영향이 큰 행동은 실행 전에 사람이 승인하게 하라는 거예요. OWASP가 드는 예시도 같아요. 내 이메일에 접근하는 비서라면 메일을 보내기 전에 내가 검토하게 해야 해요.

Binome360이 바로 이렇게 움직여요. 비서가 기록이나 문서를 준비해서 보여 주고, 확인하기 전에는 아무것도 저장되지 않아요.

Binome360으로 해 보기
내 비서Binome360

점심 9,500원 현금으로 냈어

준비됐어요: 지출 9,500원, 항목 식비, 계좌 현금, 오늘. 저장할까요?

지출9,500원식비 · 현금 · 오늘확인수정

항목이나 금액이 틀리면 저장 전에 고치면 돼요. 내가 괜찮다고 하기 전에는 아무것도 기록되지 않아요.

Binome360 무료로 써 보기

Binome360이 하지 않는 일도 분명히 할게요. 은행에 연결되지 않고, 돈을 옮기지 않고, 투자 조언을 하지 않고, 스스로 내 지출을 분석해서 알림을 보내지도 않아요. 계좌, 리마인더, 메모리, 견적서, 청구서를 내 통제 아래에서 보관할 뿐이에요.

돈, 건강, 법률: AI가 결정하면 안 되는 곳

  • 돈. 지출을 챙기고, 예산 초안을 짜고, 용어를 설명받는 데(“연이율이 뭐야?”) AI를 쓰세요. 투자 종목을 고르는 데는 쓰지 마세요. 2024년 1월 미국 증권거래위원회(SEC), 금융산업규제청(FINRA), 북미증권감독자협회(NASAA)는 공동 경고에서 투자 결정에 AI가 만든 정보에만 의존하지 말라고 했어요. 그런 정보는 “잘못됐거나 완전히 지어낸 것일 수도” 있고, AI가 수익을 보장한다는 주장은 경계하라고요. 같은 경고는 AI로 복제한 가족 목소리가 돈을 요구하는 수법도 다루는데, 가족끼리 확인용 암호 문구를 정해 두는 걸 한 가지 방어책으로 제안해요.
  • 건강. 진료 준비에는 AI가 도움이 돼요. 증상, 언제 시작됐는지, 무엇을 물어볼지 정리하기. 진단과 치료는 의사, 간호사, 약사의 몫이에요. 응급 상황이라면 챗봇이 아니라 119에 전화하세요.
  • 법률. 계약서나 편지를 이해하기 쉽게 풀어 달라고 할 수는 있어요. 이의 제기, 서명, 소송처럼 행동하기 전에는 공식 안내를 확인하고(영국은 GOV.UK, 미국은 주 법원의 셀프 헬프 페이지, 한국은 대한법률구조공단 같은 곳) 자격 있는 전문가와 상담하세요.

개인정보: 시작하기 전에 물어볼 다섯 가지

개인 비서는 내 지출, 이름, 주소, 때로는 건강 걱정까지 봐요. 먼저 물어보세요.

생활 속 잡무를 AI 비서 앱에 맡기기 전에
  • 내 대화가 모델 학습에 쓰이나요? 거부할 수 있나요?
  • 내 데이터는 어디에, 얼마나 오래 저장되나요?
  • 내 데이터를 쉽게 내보내고 삭제할 수 있나요?
  • 비서가 혼자 행동하나요, 아니면 행동마다 내 확인을 받나요?
  • 내 대화를 또 누가 볼 수 있나요 (배우자, 가족, 팀과 공유하는 공간)?
  • 비밀번호, PIN, 전체 카드 번호는 절대 입력하지 않는다
개인정보 처리방침이 이 질문들에 분명히 답하지 않는다면, 그것 자체가 답이에요.

참고할 점 몇 가지.

  • 학습. 주요 AI 비서 대부분에는 내 대화가 모델 개선에 쓰이지 않게 하는 설정이 있어요. 2025년 10월 프랑스 개인정보 감독기관(CNIL)은 ChatGPT(“Improve the model for everyone”), Claude(“Help improve Claude”), Copilot, Gemini 등에서 그 설정이 어디 있는지 정리했어요. 설치한 날 바로 확인하세요.
  • 약속은 지켜야 하는 것. 미국 연방거래위원회(FTC)는 2024년 1월 AI 기업들에게, 고객 데이터를 모델 학습에 쓰지 않겠다는 약속 같은 개인정보 약속을 어기면 법 위반이 될 수 있고, 이용약관을 슬쩍 바꾸는 것도 위험하다고 경고했어요.
  • 영국에서의 권리. 영국 개인정보 보호법에 따라 기관에 내 개인정보 사본을 요청(정보주체 열람 요청)하고, 삭제를 요구하고, 이용 방식에 이의를 제기할 수 있어요. 영국 정보위원회(ICO)는 기관이 보통 한 달 안에 열람 요청에 답해야 한다고 안내해요. 한국에서도 개인정보 보호법에 따라 내 개인정보의 열람, 정정·삭제, 처리 정지를 요구할 수 있어요.

자주 묻는 질문

가장 좋은 AI 비서 앱은 뭔가요?

하나의 승자는 없고, 모델은 몇 달마다 바뀌어요. 내 쓰임새로 판단하세요. 시키는 일을 해내는지, 행동하기 전에 무엇을 할지 보여 주는지, 내 데이터로 무엇을 하는지요. 가계부, 리마인더, 청구서처럼 목적이 분명한 앱이 특정 일에는 범용 챗봇보다 더 믿을 만한 경우가 많아요.

ChatGPT도 개인 비서인가요?

초안 쓰기, 요약, 질문 답변에서는 그 역할을 할 수 있어요. 개인 비서 앱은 보통 여기에 내 정보에 대한 기억, 실제로 알림이 오는 리마인더, 지출이나 문서처럼 다시 볼 수 있는 기록을 더해요.

AI 비서가 재무 설계사나 의사를 대신할 수 있나요?

아니에요. 이해하고, 정리하고, 질문을 준비하는 데는 도움이 돼요. Nature Medicine 시험에서 AI의 도움을 받은 사람들은 그렇지 않은 사람들보다 더 나은 의료 판단을 내리지 못했어요. 투자라면 미국 감독 당국이 AI가 만든 정보에만 의존하지 말라고 하고, 건강이라면 의료진을 찾아가세요.

AI는 왜 없는 말을 지어낼까요?

검증된 글이 아니라 가장 그럴듯한 글을 만들어 내기 때문이고, 학습과 평가가 오랫동안 “모르겠어요”보다 자신 있는 답에 점수를 줬기 때문이에요. 출처를 요청하고 직접 확인하세요.

정리

AI 비서는 준비해 주는 것으로 제 몫을 해요. 기록된 지출, 설정된 리마인더, 깔끔한 초안이요. 사실 앞에서는 여전히 틀릴 수 있고, 돈, 건강, 법률 문제를 혼자 결정해서는 안 돼요. 행동하기 전에 묻고, 내 데이터가 어떻게 되는지 분명히 밝히는 비서를 고르세요.

첫걸음: 지금 쓰고 있는 AI 비서의 설정을 열어, 내 대화가 학습에 쓰이는지 확인해 보세요.

출처

  • Pew Research Center, “Americans and AI 2026: Chatbots, Smart Devices and Views on Impact”, 2026년 6월 17일 (미국 성인 5,119명 조사, 2026년 2월 17–23일): pewresearch.org.
  • EBU and BBC, News Integrity in AI Assistants, 2025년 10월: ebu.ch/research/open/report/news-integrity-in-ai-assistants.
  • Adam Tauman Kalai, Ofir Nachum, Santosh S. Vempala and Edwin Zhang, “Why Language Models Hallucinate”, arXiv:2509.04664, 2025년 9월: arxiv.org/abs/2509.04664.
  • Matthew Dahl, Varun Magesh, Mirac Suzgun and Daniel E. Ho, “Large Legal Fictions: Profiling Legal Hallucinations in Large Language Models”, Journal of Legal Analysis, 16(1), 2024: arxiv.org/abs/2401.01301.
  • Mata v. Avianca, Inc., 678 F.Supp.3d 443 (S.D.N.Y., 2023년 6월 22일).
  • Andrew M. Bean et al., “Reliability of LLMs as medical assistants for the general public: a randomized preregistered study”, Nature Medicine, 32, 2026: nature.com/articles/s41591-025-04074-y.
  • OWASP GenAI Security Project, “LLM06:2025 Excessive Agency”: genai.owasp.org/llmrisk/llm062025-excessive-agency.
  • SEC Office of Investor Education and Advocacy, NASAA and FINRA, “Artificial Intelligence (AI) and Investment Fraud”, 투자자 경고, 2024년 1월 25일: finra.org/investors/insights/artificial-intelligence-and-investment-fraud.
  • Federal Trade Commission, Office of Technology, “AI Companies: Uphold Your Privacy and Confidentiality Commitments”, 2024년 1월 9일: ftc.gov.
  • Information Commissioner’s Office, “Getting copies of your information (subject access request)”와 “Your right to get your data deleted”: ico.org.uk/for-the-public.
  • CNIL, “IA et vie privée : comment s’opposer à la réutilisation de ses données personnelles pour l’entraînement d’agents conversationnels ?”, 2025년 10월: cnil.fr.

다른 언어로도 제공 English, Français, Español, Português, Deutsch, Italiano, Türkçe, Bahasa Indonesia, Bahasa Melayu, Tiếng Việt, ไทย, 日本語, 繁體中文, العربية.