惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

博客园 - 聂微东
Y
Y Combinator Blog
WordPress大学
WordPress大学
L
LangChain Blog
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
A
About on SuperTechFans
小众软件
小众软件
有赞技术团队
有赞技术团队
S
SegmentFault 最新的问题
宝玉的分享
宝玉的分享
Recent Announcements
Recent Announcements
GbyAI
GbyAI
I
InfoQ
The GitHub Blog
The GitHub Blog
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
酷 壳 – CoolShell
酷 壳 – CoolShell
罗磊的独立博客
C
Check Point Blog
V
V2EX
Apple Machine Learning Research
Apple Machine Learning Research
月光博客
月光博客
量子位
雷峰网
雷峰网
Hugging Face - Blog
Hugging Face - Blog

ZDNet Korea

여기어때, 해양 관광 레저·티켓 할인 쿠폰 쏜다 11번가, 5월 바다여행지 숙박·체험 상품 할인 패스트파이브, 작년 매출 1500억원·영업익 60억원 혼다코리아, '뉴 파일럿 블랙 에디션' 사전 계약…7880만원 카카오엔터 추천 4월 화제의 신작 웹툰 4선 휴먼컨설팅그룹, 연구개발 허브 ‘양재센터’ 신설 더벤처스, K뷰티 '클레버스텝스' 시드 투자 민주당 "지방선거 이후 디지털자산기본법 논의 본격화" KFC, 가맹점주 대상 프랜차이즈 컨벤션 개최 스타벅스, 장애인의 날 맞아 공모전 수상작 굿즈 출시 "URL 포함된 고유가 지원금 알림 문자는 사기" 2025년 원화 결제 수출 비중 3.4%…역대 최고 삼양사, 국제베이커리페어 첫 참가…냉동생지 ‘프레팡’ 공개 문체부 콘텐츠 R&D 확대, 현장 체감은 엔비디아, '빌드 어 클로' 한국 첫 공개…"AI 에이전트 직접 구축" LS일렉트릭, 북미 데이터센터에 1700억 규모 전력 설비 공급 스타스테크, 콜라겐 스킨케어 ‘라보페’ 리브랜딩...국내외 유통망 확장 네이버 사우디 직원들 다시 사무실로…중동 사업 재궤도 올해는 결론 나오나…배달앱 사회적 대화기구 재출범부터 ‘균열’ [이종천] 2026년 통신시장, 아직 단통법 시절 ‘금난전권’ 그림자에 갇혀 있는가 KOSA, 의료·바이오 AI 인재 양성…실무형 교육 강화 빅밸류, 10년 만 첫 흑자…"올해 매출 100억원 목표" 트럼프, 호르무즈 해협 봉쇄령…"이란에 통행료 낸 선박 차단" 우리 동네 교통·안전 문제, ‘도시 데이터’로 해결 환경분야 시험·검사 전문성 ↑…산업계 수요 반영, 고난도 분석기술 교육 靑 "종전선언까지 비상대응...매점매석 금지 추가검토" "D램 가격 상승률, 1분기 70%→2분기 30~50%로 둔화 전망" "판교 정보보호클러스터 확 달라져"...9년만에 시설 대폭 개선 보안 개념이 바뀐다...'미토스 보고서' 7월 발표 벤츠, 전국 어디서나 같은 가격…다이렉트 직판제 전환
"너는 OO 전문가야"...AI 페르소나 프롬프팅, 효과 있을까?
백봉삼 기자 · 2026-05-03 · via ZDNet Korea

인공지능(AI)에게 특정 분야의 전문가라는 역할을 부여하는 '페르소나 프롬프팅'이 실제로는 코딩이나 수학처럼 정밀한 지식이 필요한 작업에서 오히려 AI의 정확도를 떨어뜨린다는 연구 결과가 나왔다.

최근 AI 사용자들 사이에서는 지시어(프롬프트)를 입력할 때 "당신은 이 분야의 숙련된 전문가입니다"라는 문구를 추가하면 성능이 향상된다는 설이 상식처럼 통용돼 왔다. 

하지만 남가주 대학교(USC) 지자오 후 연구팀이 최근 프리프린트 서버 'arXiv'에 게재한 논문에 따르면, 이런 방식은 분야에 따라 득보다 실이 많을 수 있는 것으로 나타났다. 이 내용은 레지스터닷컴·기가진 등 외신을 통해 보도됐다.

AI에게 특정 분야의 전문가라는 역할을 부여하는 '페르소나 프롬프팅'이 실제로는 코딩이나 수학처럼 정밀한 지식이 필요한 작업에서 오히려 AI의 정확도를 떨어뜨린다는 연구 결과가 나왔다.(제공=클립아트코리아)

'전문가인 척' 하느라 전문 지식 놓치는 AI

외신에 따르면, 연구팀은 'Llama-3.1-8B'와 'Qwen 2.5-7B' 등 6종의 AI 모델을 대상으로 실험을 진행했다. AI에게 단순히 "당신은 소프트웨어 엔지니어입니다"라고 짧게 지시하거나, 혹은 전문 지식과 경험이 풍부하다는 식의 복잡한 페르소나를 부여한 뒤 성능을 측정했다.

실험 결과, 여러 차례의 대화를 통해 품질을 평가하는 'MT-Bench' 테스트에서는 글쓰기나 추론 분야의 출력 품질이 향상되는 긍정적인 효과가 나타났다. 특히 AI가 인간의 윤리관에 어긋나는 답변을 하지 않도록 하는 'AI 얼라인먼트(정렬)' 측면과 보안 취약점을 이용한 공격(Jailbreak) 방어력은 크게 개선됐다.

반면, 실제 정답률이 중요한 코딩·수학·인문과학 분야에서는 오히려 품질이 하락했다. 광범위한 지식 측정 지표인 'MMLU' 벤치마크에서도 "당신은 전문가입니다"라고 지시했을 때 전체적인 정확도가 눈에 띄게 떨어졌다.

관련기사

 "역할 수행에 능력 낭비... 구체적 요구사항 전달이 효과적"

특정 분야 업무에선 페르소나 부여보다, 프로젝트 요건과 요구사항을 상세하게 전달하는 것이 사용자가 원하는 결과물을 얻는 데 효과적일 수 있다.(이미지=챗GPT 캡처)

연구팀은 이러한 현상의 원인을 AI의 자원 배분 문제로 분석했다. AI에게 전문가 역할을 부여한다고 해서 없던 전문 지식이 실제로 생겨나는 것은 아니다. 오히려 AI가 '전문가처럼 보이게 답변하는 것(지시 추종)'에 능력을 집중하느라, 정작 사실을 기억해내고 계산하는 데 써야 할 능력을 소진하게 된다는 설명이다.

연구를 주도한 후 씨는 "AI에게 '당신은 숙련된 프로그래머'라고 말하는 것은 코드의 품질을 높이는 데 도움이 되지 않는다"며 "오히려 프로젝트 요건과 요구사항을 상세하게 전달하는 것이 사용자가 원하는 결과물을 얻는 데 훨씬 효과적"이라고 조언했다.