AI가 만든 피싱 메일, 기존 탐지기는 왜 놓칠까? 새로운 LLM에도 통하는 탐지 전략 공개

이미지
생성형 AI가 만든 피싱 메일은 점점 정교해지고 있지만, 여러 AI 모델을 함께 학습하거나 탐지 기준을 보정하면 새로운 LLM이 생성한 피싱 메일도 높은 정확도로 탐지할 수 있음을 보여주는 개념 이미지. 생성형 AI 시대의 피싱 공격은 더 정교해졌지만, 탐지 성능을 유지하는 방법도 함께 제시됐다. 생성형 AI의 발전으로 피싱 메일은 맞춤법 오류나 어색한 문장 대신 자연스럽고 설득력 있는 문체를 갖추기 시작했다. 하지만 AI가 만든 피싱 메일을 탐지하는 모델에도 새로운 문제가 생겼다. 특정 AI 모델이 만든 메일만 잘 찾아낼 뿐, 다른 AI 모델이 생성한 피싱 메일에서는 성능이 크게 떨어지는 경우가 많았기 때문이다. 최근 발표된 연구는 이 문제가 탐지 모델 자체의 한계가 아니라 판단 기준(Threshold) 설정에 있다는 점을 보여줬다. 연구진은 간단한 임계값 조정이나 여러 AI 모델의 데이터를 함께 학습하는 방식만으로도 탐지 성능을 거의 원래 수준까지 회복할 수 있음을 확인했다. 서로 다른 AI가 만든 피싱 메일도 같은 방식으로 탐지할 수 있을까 기존 연구들은 GPT 계열처럼 하나의 AI 모델이 만든 피싱 메일을 대상으로 높은 정확도를 보고했다. 하지만 실제 공격자는 언제든 다른 생성형 AI를 사용할 수 있다. 오늘은 GPT를 쓰다가 내일은 Llama나 DeepSeek를 사용하는 상황도 충분히 가능하다. 이 연구는 바로 이 현실적인 문제를 검증했다. 연구진은 "한 AI에서 학습한 탐지기가 다른 AI가 만든 피싱 메일도 제대로 찾아낼 수 있는가"를 핵심 질문으로 설정했다. 약 1만 건의 피싱 메일로 대규모 실험을 진행했다 연구진은 총 9,986개의 피싱 메일 데이터셋을 구축했다. • 사람이 작성한 실제 피싱 메일 5,000건 • GPT-4.1 생성 메일 1,665건 • DeepSeek 3.2 생성 메일 1,665건 • Llama 3.3 70B 생성 메일 1,656건 AI가 생성한...

쓰레기통 앞에서 망설이지 않는 AI, EcoSortBin이 보여준 ‘덜 배우는 기술’

이미지
EcoSortBin은 카메라로 폐기물을 인식하고 AI와 센서 정보를 결합해 적절한 수거함으로 분류하는 시스템이다. 연구진은 범용 시각 지식을 보존하면서 일부 신경망만 선택적으로 학습해 기존 폐기물의 인식 정확도와 새로운 물체에 대한 일반화 능력 사이의 균형을 시도했다. 새로운 포장재가 계속 등장하는 현실에서, AI가 이미 배운 지식을 잃지 않으면서 새로운 것을 알아보게 만드는 방법 쓰레기통 앞에서 잠깐 손이 멈출 때가 있다. 다 마신 음료병 하나를 들고도 플라스틱인지 일반 쓰레기인지, 라벨은 떼야 하는지, 뚜껑은 어디에 넣어야 하는지 판단이 애매하다. 사람도 그런데 기계라고 사정이 크게 다르지는 않다. AI에게 수천 장의 페트병 사진을 보여주면 페트병을 꽤 잘 알아본다. 캔과 종이, 비닐봉지도 마찬가지다. 문제는 어느 날 처음 보는 포장재가 쓰레기통 위에 놓였을 때다. 기존의 폐기물 분류 AI는 대개 자신이 배운 정답 목록 안에서 답을 골라야 한다. 세상에는 새로운 물건이 계속 나오는데 AI의 세계는 학습이 끝난 날 멈춰 있는 셈이다. 2026년 학술지 AI 에 발표된 EcoSortBin 연구는 바로 이 간극을 다룬다. 연구진은 AI 전체를 캠퍼스 쓰레기에 맞게 뜯어고치는 대신, 이미 가지고 있던 일반적인 시각 지식을 최대한 보존하면서 필요한 부분만 선택적으로 학습시켰다. 그 결과 학습한 7종의 폐기물에서는 73.5%의 top-1 정확도를 확보하면서 다른 환경과 새로운 물체를 인식하는 능력도 일부 유지했다. 더구나 이 시스템은 거대한 GPU 서버가 아니라 라즈베리파이 4에서 작동하도록 설계됐다. 세상은 계속 변하는데 AI의 정답지는 일곱 칸뿐이었다 대학 캠퍼스의 쓰레기통을 떠올려 보자. 어제까지 없던 음료가 편의점 진열대에 등장하고, 같은 음료도 병 모양과 라벨이 바뀐다. 배달 음식이 유행하면 새로운 용기가 쌓이고 계절이 바뀌면 소비되는 제품도 달라진다. 이런 변화는 사람에게는 사소해 보이지만 기존 AI에는 꽤 어려운 문제다....

벼 재배지 추출 정확도를 높인 AI, 광학과 SAR 영상을 함께 보면 무엇이 달라질까?

이미지
광학 위성영상과 SAR 레이더 영상을 함께 분석해 벼 재배지를 식별하는 AI 기반 원격탐사 과정을 시각화했다. 구름과 복잡한 농경지 환경에서 두 데이터의 상호보완성과 경계 추출의 중요성을 보여준다. 구름 때문에 보이지 않는 논도 AI는 더 정확하게 찾아낼 수 있을까? 최신 연구는 광학 위성영상과 레이더(SAR) 영상을 함께 활용하는 새로운 딥러닝 모델이 기존 방법보다 더 높은 정확도로 벼 재배지를 구분할 수 있음을 보여줬다. 벼는 세계 식량 안보를 책임지는 가장 중요한 작물 가운데 하나다. 어느 지역에서 얼마나 재배되는지를 정확하게 파악하면 생산량 예측은 물론 농업 정책과 재해 대응에도 큰 도움이 된다. 하지만 위성영상으로 벼를 찾는 일은 생각보다 쉽지 않다. 광학 위성은 구름과 안개의 영향을 크게 받고, 레이더(SAR)는 날씨와 관계없이 관측할 수 있지만 영상에 잡음이 많고 세부 형태를 표현하는 데 한계가 있다. 연구진은 이 두 종류의 데이터를 단순히 합치는 대신 각각의 장점을 최대한 활용하는 새로운 인공지능 모델을 개발했다.  왜 광학 영상만으로는 벼를 찾기 어려울까 일반적인 위성영상은 식물의 색과 반사 특성을 이용해 작물을 구분한다. 하지만 벼 재배지는 습도가 높은 지역에 많아 성장기에는 구름이나 비가 자주 발생한다. 그 결과 중요한 시기의 영상이 비어 있거나 품질이 크게 떨어질 수 있다. 반대로 SAR(Synthetic Aperture Radar)은 전파를 이용하기 때문에 밤이나 흐린 날에도 관측할 수 있다. 또한 논의 수분 상태와 식생 구조 변화에도 민감하게 반응한다. 문제는 SAR만 사용할 경우다. 습지, 물, 다른 농작물도 비슷한 신호를 보일 수 있어 오분류가 발생하기 쉽다. 결국 두 영상을 함께 활용하는 것이 가장 합리적인 접근이지만, 서로 특성이 너무 달라 단순히 합치는 것만으로는 충분하지 않다. 연구진이 새롭게 제안한 ACBE-CroFuseNet 이번 연구에서 제안한 모델 이름은 ACBE-Cro...

AI 튜터는 정말 ‘소크라테스식 질문’을 하고 있을까? 737건의 대학생 대화를 분석한 연구

이미지
소크라테스식 질문을 통해 학생의 사고를 이끌어가는 교육용 AI의 모습을 상징적으로 표현한 이미지. 이번 연구는 AI가 학생과의 대화에서 어떤 질문 전략을 사용하는지 분석했으며, 학습 효과 자체가 아니라 대화 패턴을 조사했다. 정답을 알려주는 AI보다 질문을 던지는 AI가 더 좋은 교사일까? 최근 교육용 AI는 단순히 답을 제공하는 수준을 넘어 학생이 스스로 생각하도록 유도하는 방향으로 발전하고 있다. 그 대표적인 방법이 바로 소크라테스식 문답(Socratic dialogue)이다. 질문을 이어가며 학생이 스스로 답을 찾도록 돕는 방식이다. 그렇다면 실제 교육 현장에서 사용하는 AI는 정말 이런 대화 방식을 구현하고 있을까? 2026년 AI 저널에 발표된 이번 연구는 콜롬비아의 원격대학에서 운영 중인 AI 튜터 MIA(Intelligent Mentor of Accompaniment)와 학생들이 나눈 737개의 실제 대화를 분석해 이 질문에 답하고자 했다. 중요한 점은 이 연구가 학생의 학습 효과를 검증한 것이 아니라 AI의 대화 방식 자체를 분석한 연구라는 점이다. 학생에게 답을 주기보다 질문을 던지는 AI 연구진은 MIA가 소크라테스식 대화를 얼마나 구현하는지 평가하기 위해 여섯 가지 대화 요소를 정의했다. 기존 지식을 먼저 확인하는가 학생의 상황을 먼저 파악하는가 실제 경험과 연결하는가 학생이 스스로 판단하도록 유도하는가 질문을 단계적으로 발전시키는가 마지막에 이해 여부를 확인하는가 이 여섯 가지가 각각 대화 속에서 얼마나 자주 등장하는지 분석했다. 흥미로운 점은 연구진이 처음부터 “교육 효과를 증명하려는 연구가 아니다”라고 여러 차례 강조했다는 점이다. AI가 이러한 질문을 했다는 사실과 학생이 실제로 더 많이 배웠다는 사실은 전혀 다른 문제이기 때문이다.  무엇을 어떻게 조사했나 연구는 단일 사례를 대상으로 한 내용분석(content analysis) 연구다. 분석 대상은 원격대학 ...

GINet-DGC: 적은 환자 데이터에서도 성능을 높인 AI, 유전자 발현 분석의 새 접근

이미지
고차원·소표본(HDLSS) 유전자 발현 데이터를 효과적으로 분석하기 위해 구조적 정보와 적응형 일반화 제어를 결합한 AI 모델 GINet-DGC의 개념을 시각적으로 표현한 이미지. 고차원 유전자 데이터는 수만 개의 변수(유전자)를 담고 있지만 환자 수는 수십~수백 명에 불과한 경우가 많다. 이런 환경에서는 인공지능이 학습하기보다 데이터를 외우는 '과적합(overfitting)'에 빠지기 쉽다. 그렇다면 적은 데이터에서도 신뢰할 수 있는 예측 모델을 만들 방법은 없을까? 최근 발표된 연구는 이러한 문제를 해결하기 위해 GINet-DGC(Global Interaction Network with Dynamic Generalization Control) 라는 새로운 딥러닝 프레임워크를 제안했다. 연구진은 단순히 신경망을 더 깊게 만드는 대신, 데이터의 구조를 학습 과정에 반영하고 과적합을 실시간으로 감시하는 방식을 도입했다. 공개된 8개의 생의학 유전자 발현 데이터셋에서 기존 17개 모델과 비교한 결과, 경쟁력 있는 성능과 안정성을 보였다고 보고했다. 왜 유전자 발현 데이터는 AI가 배우기 어려울까? 일반적인 딥러닝은 데이터가 많을수록 강점을 보인다. 하지만 생명과학 연구에서는 상황이 다르다. 암 진단이나 질병 예측에 사용되는 유전자 발현 데이터는 보통 수만 개의 유전자 정보 를 포함하지만, 실제 환자 수는 수십 명에서 많아야 수백 명 수준인 경우가 흔하다. 이처럼 변수는 매우 많고 표본은 적은 데이터 를 HDLSS(High-Dimensional Low-Sample-Size) 데이터라고 부른다. 이 환경에서는 모델이 질병과 관련된 패턴을 배우기보다 우연히 나타난 노이즈까지 외워버릴 가능성이 높다. 연구진은 기존 딥러닝 모델들이 이러한 환경에서 학습이 불안정하고 일반화 성능이 떨어지는 이유가 바로 여기에 있다고 설명했다. 기존 모델과 무엇이 달랐나 연구진은 첫 번째 신경망 층의 가중치를 직접 학습하지 ...

AI와 혈액검사만으로 수면무호흡증 중증도 예측 가능한가? XGBoost 머신러닝 연구가 보여준 가능성

이미지
혈액검사와 기본 임상정보를 머신러닝으로 분석해 수면무호흡증 중증도를 예측하는 AI 기반 선별검사 기술을 표현한 이미지. 수면다원검사 없이도 중증 환자를 먼저 선별할 수 있는 인공지능 모델이 제안됐다. 잠을 자는 동안 반복적으로 호흡이 멈추는 폐쇄성 수면무호흡증(OSAHS)은 고혈압, 심혈관질환, 당뇨병, 뇌졸중 위험을 높이는 대표적인 수면질환이다. 하지만 정확한 진단을 위해서는 하룻밤 동안 병원에서 시행하는 수면다원검사(PSG)가 필요해 비용과 접근성의 한계가 있다. 최근 발표된 연구에서는 혈액검사와 기본 건강검진 정보만으로 수면무호흡증의 중증도를 예측하는 머신러닝 모델 을 개발했다. 연구 결과 다섯 가지 인공지능 모델 가운데 XGBoost가 가장 우수한 성능을 보였으며, 중등도 이상의 환자를 선별하는 보조도구로 활용 가능성을 확인했다. 병원마다 수면다원검사를 받기 어려운 이유 폐쇄성 수면무호흡증은 전 세계적으로 수억 명이 앓고 있는 흔한 질환이다. 그러나 진단률은 매우 낮다. 가장 큰 이유는 표준검사인 수면다원검사가 시간과 비용이 많이 들고 전문 장비와 숙련된 인력이 필요하기 때문이다. 이 때문에 실제 임상에서는 코골이나 주간 졸림 증상이 있어도 검사를 받지 못하거나 진단이 늦어지는 경우가 적지 않다. 연구진은 이러한 문제를 해결하기 위해 병원에서 쉽게 얻을 수 있는 임상정보만으로 중증도를 예측할 수 있는 모델을 개발하고자 했다. 432명의 임상 데이터를 이용해 AI를 학습했다 연구에는 중국 취징중앙병원 환자 432명이 참여했다. 연구진은 나이, 성별, BMI(체질량지수), 혈압, 혈당, 적혈구와 혈소판 수치, 간 기능 검사, 신장 기능 검사, 호모시스테인(HCY), 총 빌리루빈(TBIL), 경동맥 초음파 결과 등 총 25개의 임상 변수를 활용했다. 환자의 70%는 AI 학습에, 나머지 30%는 성능 검증에 사용했다. 또한 과적합을 줄이기 위해 5겹 교차검증과 하이퍼파라미터 최적화를 적용했다. ...

전력설비 점검도 이제 AI 로봇이? 체화지능이 바꾸는 전력산업의 미래

이미지
체화지능(Embodied Intelligence)을 적용한 휴머노이드 로봇, 사족보행 로봇, 드론이 협력해 전력설비를 점검하고 유지보수를 수행하는 미래 전력 산업의 개념도. 사람의 위험한 현장 작업을 줄이고 안전성과 운영 효율을 높이는 차세대 기술을 표현했다. 사람 대신 위험한 전력 현장에 투입되는 '체화지능(Embodied Intelligence)' 기술의 현재와 한계를 살펴보다 전력설비를 점검하거나 고압 송전선을 수리하는 작업은 산업 현장에서도 가장 위험한 업무에 속한다. 높은 곳에서 작업해야 하고, 감전 위험은 물론 태풍이나 산사태 같은 재난 상황에서도 긴급 복구가 필요하기 때문이다. 최근 이러한 문제를 해결할 차세대 기술로 체화지능(Embodied Intelligence, EI) 이 주목받고 있다. 단순히 AI가 판단만 하는 것이 아니라, 로봇이 직접 보고(Perception), 이해하고(Cognition), 행동하는(Execution) 하나의 통합 시스템이다. 2026년 발표된 리뷰 논문은 지금까지의 연구 125편을 분석해 전력 시스템에서 체화지능이 어디까지 발전했으며 앞으로 어떤 과제를 해결해야 하는지를 종합적으로 정리했다. 기존 전력 점검 로봇은 왜 한계에 부딪혔을까 지금도 변전소나 송전선에는 다양한 점검 로봇이 사용된다. 하지만 대부분은 미리 입력된 경로를 따라 움직이는 수준이다. 예를 들어 작업 차량이 예상하지 못한 위치에 주차되어 있거나, 태풍으로 지형이 바뀌거나, 공사 장비가 놓여 있으면 로봇은 스스로 판단하지 못하고 작업을 중단하는 경우가 많다. 연구진은 이러한 이유를 기존 로봇이 인지와 행동이 분리된 구조 를 사용하기 때문이라고 설명한다. 즉, 장애물을 발견해도 그것이 무엇인지 이해하거나 새로운 방법을 계획하는 능력이 부족하다. 체화지능은 '보고-생각하고-행동하는' 하나의 시스템이다 논문은 체화지능의 핵심을 'Brain-Body Integration...