사이버물리시스템 침입탐지, 양자 영감 AI와 딥러닝을 결합하면 탐지 성능은 얼마나 좋아질까?

이미지
양자 영감 AI와 딥러닝 앙상블을 활용해 산업용 사이버물리시스템의 사이버 공격을 탐지하고 보호하는 차세대 침입탐지시스템(IDS)을 표현한 개념도. 기존 딥러닝 기반 침입탐지시스템(IDS)은 높은 성능을 보이지만 과적합과 특징 선택의 한계 때문에 새로운 공격이나 복잡한 산업 환경에서는 성능이 떨어질 수 있다. 최근 발표된 연구는 이러한 문제를 해결하기 위해 양자 영감(Quantum-inspired) 기술과 여러 딥러닝 모델을 결합한 새로운 앙상블 기반 침입탐지 기법을 제안했다. 공장 자동화 설비, 스마트 전력망, 자율주행 시스템처럼 컴퓨터와 물리 장비가 긴밀하게 연결된 사이버물리시스템(Cyber-Physical System, CPS)은 보안 사고가 발생하면 단순한 정보 유출을 넘어 실제 설비 오작동이나 안전사고로 이어질 수 있다. 이러한 이유로 CPS에서는 공격을 조기에 탐지하는 IDS가 매우 중요한 역할을 수행한다. 왜 새로운 침입탐지 기술이 필요했을까 사이버물리시스템은 일반 IT 네트워크보다 훨씬 복잡하다. 수많은 센서와 액추에이터가 실시간으로 데이터를 주고받으며 다양한 통신 프로토콜과 운영체제를 함께 사용한다. 정상 상태도 시간에 따라 계속 변화하기 때문에 단순한 규칙 기반 탐지만으로는 새로운 공격을 찾아내기 어렵다. 최근에는 머신러닝과 딥러닝 기반 IDS가 널리 활용되고 있지만, 충분한 학습 데이터가 없거나 새로운 공격 패턴이 등장하면 탐지 정확도가 떨어질 수 있다. 또한 불필요한 특징까지 함께 학습하면서 과적합이 발생하고 계산량이 증가하는 문제도 남아 있다. 연구진은 이러한 한계를 해결하기 위해 데이터 전처리부터 특징 추출, 특징 선택, 침입 탐지까지 전체 과정을 새롭게 설계했다.  좋은 특징을 찾는 것이 성능을 좌우했다 이번 연구에서 가장 눈에 띄는 부분은 입력 데이터를 더욱 의미 있는 형태로 만드는 과정이다. 연구진은 먼저 데이터 정제를 수행해 결측값과 불필요한 데이터를 제거한 뒤 다양한 특징을...

암호 해독: 인공지능은 고대 언어를 해독하는 데 도움을 줄 수 있을까?

이미지
고대 문자와 현대 인공지능 기술의 결합을 상징적으로 표현한 이미지. 인공지능은 미해독 언어의 방대한 문자 패턴을 분석해 연구를 가속하지만, 최종적인 의미 해석과 검증은 여전히 인간 연구자의 몫이다. The Conversation 이 글의 의의 고대 언어 해독은 오랫동안 언어학과 고고학이 함께 풀어온 가장 어려운 학문적 과제 가운데 하나였다. 이 글은 최근 인공지능이 이러한 난제 해결에 어떤 방식으로 기여하고 있으며, 동시에 어디까지가 가능한 영역인지를 균형 있게 조명한다. 특히 인공지능이 의미를 '이해'하는 것이 아니라 방대한 자료 속에서 패턴을 찾아 인간 연구를 가속하는 도구라는 점을 명확히 설명한다. 또한 해독에는 비교 기준과 엄격한 인간의 검증이 여전히 필수적이라는 사실을 강조함으로써, 인공지능 시대에도 인간의 창의성과 학문적 판단이 핵심임을 일깨워 준다. 나아가 인공지능과 인문학이 경쟁 관계가 아니라 상호 보완적인 협력 관계임을 보여주는 대표적인 사례를 제시한다. 암호 해독: 인공지능은 고대 언어를 해독하는 데 도움을 줄 수 있을까? 지금까지 해독에 성공한 모든 고대 언어에는 반드시 해독의 기준점이 존재했다. 대개는 로제타석과 같은 이중 언어 비문이거나, 비교 대상으로 삼을 수 있는 알려진 친족 언어였다. 그러나 그리스 크레타섬 청동기 시대 미노스 문명의 문자 체계인 선문자 A(Linear A) 에는 이러한 기준점이 전혀 존재하지 않는다. 선문자 A는 현존하거나 이미 사라진 어떤 언어와도 확인된 계통적 연관성이 없어 고립어(language isolate) 로 분류된다. 이 때문에 지난 한 세기 동안 언어학자들에게 가장 난해한 미해독 언어 가운데 하나로 남아 있다. 로마 제국이 등장하기 이전 이탈리아에서 사용된 에트루리아어(Etruscan) 역시 사정은 크게 다르지 않다. 짧은 장례 비문을 통해 일부 어휘는 밝혀졌지만, 문법 체계와 문장의 깊은 의미는 여전히 명확히 규명되지 않고 있다. 이처럼 두 ...

기업 실적 예측 AI의 한계를 넘다… 인과관계까지 설명하는 'TRuE-XAI' 프레임워크 등장

이미지
투명성과 신뢰성을 상징하는 투명한 인공지능(AI) 신경망 뇌와 상승하는 재무 예측 데이터 흐름을 시각화한 고도화된 하이테크 디지털 일러스트레이션 단순히 "맞히는 AI"가 아니라, 왜 그런 예측을 했는지까지 설명하는 새로운 금융 AI가 제안됐다. 기업의 미래 실적을 예측하는 AI는 이미 투자와 신용평가 분야에서 널리 활용되고 있다. 하지만 대부분의 인공지능은 높은 정확도를 보여도 왜 특정 기업의 실적이 좋아질 것이라고 판단했는지는 명확하게 설명하지 못한다. 금융처럼 규제와 책임이 중요한 분야에서는 이러한 '블랙박스 AI'가 큰 한계로 지적돼 왔다. 최근 발표된 연구는 이러한 문제를 해결하기 위해 예측 성능과 설명 가능성, 그리고 인과관계 분석을 하나로 통합한 새로운 프레임워크 TRuE-XAI(Transparent, Rule-based and Explainable AI) 를 제안했다. 연구진은 미국 SEC에 제출된 실제 상장기업 재무제표를 이용해 미래 이익 증가를 예측했으며, 단순한 상관관계가 아니라 실제로 실적 개선에 영향을 주는 재무지표까지 분석했다. 기존 실적 예측 AI는 왜 신뢰하기 어려운가 기업의 실적 전망은 투자자뿐 아니라 은행, 신용평가기관, 기업 경영진에게도 매우 중요한 정보다. 미래 이익이 증가할 가능성을 미리 알 수 있다면 투자 전략을 세우거나 대출 위험을 줄이는 데 큰 도움이 된다. 문제는 기존 예측 모델이 두 가지 한계를 가지고 있었다는 점이다. 첫 번째는 전통적인 통계모델이다. 선형적인 관계를 가정하기 때문에 실제 기업의 복잡한 재무 구조를 충분히 반영하지 못했다. 두 번째는 머신러닝이다. Random Forest나 XGBoost 같은 최신 알고리즘은 예측 성능은 뛰어나지만 왜 그런 결과가 나왔는지를 설명하기 어렵다. SHAP이나 LIME 같은 설명 기법도 존재하지만, 이들은 어디까지나 '관련성이 높은 변수'를 알려줄 뿐 실제 원인을 증명하지는 ...

중학생 수학 서술형 평가의 자동 피드백: 비지도 학습과 거대언어모델의 만남

이미지
의미 기반 클러스터링을 활용해 학생들의 수학 풀이를 분석하고, 대규모 언어모델(LLM)이 맞춤형 피드백을 생성하는 과정을 개념적으로 표현한 이미지. 교실에서 학생들이 작성한 수학 서술형 답안을 하나씩 읽고 맞춤형 피드백을 건네는 일은 상당한 시간이 소요되는 과정이다. 최근 거대언어모델(LLM)이 교육 현장의 이러한 평가 부담을 덜어줄 대안으로 주목받고 있지만, 인공지능이 참고할 모범 답안이나 예시를 사람이 직접 일일이 골라 프롬프트에 입력해야 하는 번거로움이 여전히 실무적 걸림돌로 남아 있다. 이러한 문제를 해결하기 위해 연구진은 비지도 의미론적 군집화 기법을 활용해 LLM 피드백용 예시를 자동으로 선별하는 방법론을 연구했다. 중학교 7학년 수학 부등식 문제를 바탕으로 100개의 모의 학생 응답을 생성하고 분석한 결과, 인공지능이 생성한 피드백의 96.42%가 교사 평가에서 수용 가능한 수준을 기록했다. 이 연구는 자동화된 군집화가 프롬프트 엔지니어링의 수고를 덜면서도 교육적으로 활용 가능한 피드백을 만들어낼 수 있음을 보여준다. 시맨틱 클러스터링으로 학생들의 논리 구조를 읽어내다 연구진은 학생들의 서술형 답안을 그대로 대입하는 대신, 문장 임베딩 모델인 Sentence-BERT를 이용해 텍스트를 고차원 벡터로 변환했다. 이어 UMAP을 통해 차원을 축소하고, 밀도 기반 군집화 알고리즘인 HDBSCAN을 적용해 학생들의 풀이 과정에 담긴 공통된 추론 패턴을 그룹화했다. 이 과정에서 기계는 정답 여부라는 기계적 분류를 넘어, 학생들이 공유하는 대수적 논리 구조를 중심 기준으로 삼았다. 예를 들어, 올바른 풀이를 상세하게 적은 집단과 핵심만 간결하게 적은 집단은 의미론적 유사성에 따라 하나의 큰 군집으로 묶였다. 이는 인공지능이 표면적인 글자 배열이 아니라 학생들이 문제를 해결하기 위해 거친 사고의 흐름 자체를 포착해 낸다는 점을 시사한다. 중심값과 경계값 예시가 이끌어낸 높은 피드백 품질 군집화된 데이터 속에서 연구진은 각 그룹의 중심에...

언어 계통이 다르면 AI의 감정 분석 성능도 달라지나? 36개 언어로 검증한 최신 LLM 비교 연구

이미지
  GPT-4o부터 Claude 3.7 Sonnet까지, 다국어 감정 분석 성능을 언어 계통이라는 새로운 관점에서 분석한 연구 소셜미디어 감정 분석은 여론 분석, 시장 조사, 의료, 교육, 정치 분야에서 널리 활용된다. 하지만 지금까지는 "AI가 여러 언어를 얼마나 잘 이해하는가"에만 관심이 집중됐고, 왜 어떤 언어에서는 잘 작동하고 어떤 언어에서는 성능이 떨어지는지 는 충분히 설명되지 않았다. 이번 연구는 GPT-4o, Gemini 2.0 Flash, Claude 3.7 Sonnet, DeepSeek-V3, Mistral Large를 대상으로 36개 언어에서 감정 분석 성능을 비교했다. 특히 언어를 개별적으로 평가하는 대신 같은 언어 계통(language family) 끼리 묶어 분석했다는 점이 기존 연구와 가장 큰 차별점이다. 결과는 분명했다. 몇 개의 예시만 제공하는 Few-shot Prompting 만으로 대부분 언어의 성능이 향상됐지만, 영어 중심으로 학습된 현재의 LLM은 여전히 저자원 언어에서는 큰 성능 격차를 보였다. 개별 언어보다 언어 계통을 살펴본 이유 기존 다국어 벤치마크는 영어, 프랑스어, 독일어처럼 언어 하나씩 결과를 비교하는 방식이 대부분이었다. 하지만 언어는 서로 독립적으로 존재하지 않는다. 예를 들어 스페인어·포르투갈어·이탈리아어는 로망스어군, 영어·독일어·스웨덴어는 게르만어군, 아랍어·암하라어는 아프로아시아어족처럼 공통 조상을 가진 언어들은 문법과 표현 방식에도 공통점이 존재한다. 연구진은 이런 계통학적 관계가 LLM 성능에도 영향을 미치는지를 확인하기 위해 36개 언어를 인도유럽어족, 아프로아시아어족, 니제르콩고어족, 튀르크어족, 오스트로네시아어족, 영어 크리올어 등으로 분류해 비교했다. 논문의 계통도(Figure 2)는 이러한 언어 계층 구조를 시각적으로 보여준다. 36개 언어, 3개의 데이터셋으로 성능을 검증했다 연구에는 총 36개 언...

인공지능 시대의 생물학, 왜 기존 데이터의 재분석에 주목해야 하는가

이미지
방대하게 쌓여 있는 생명과학 데이터를 다시 분석하는 일이 왜 새로운 발견의 핵심 열쇠가 될까 생명과학 기술이 빠르게 발전하면서 매일 엄청난 양의 생물학 데이터가 쏟아져 나오고 있다. 하지만 이렇게 수집된 데이터의 대부분은 처음 연구가 끝난 뒤에 제대로 활용되지 못한 채 방치되는 경우가 많다.  최근 과학계에서는 새로운 실험을 무조건 늘리기보다, 이미 공개된 방대한 데이터를 인공지능과 새로운 관점으로 다시 분석하는 작업이 중요하다는 목소리가 커지고 있다. 이 글에서는 인공지능 시대에 데이터 재분석이 왜 필수적인지, 그리고 이를 통해 어떤 가능성과 과제가 열리 비용과 환경적 부담을 줄이면서도 과학적 혁신을 이룰 수 있는지 살펴본다. 데이터 재분석이 생명과학 연구에서 가지는 의미와 중요성 과학의 역사에서 위대한 발견은 언제나 새로운 실험에서만 비롯되지 않았다. 과거 요하네스 케플러는 티코 브라헤가 남긴 방대한 천문학 관측 데이터를 철저하게 다시 분석함으로써 행성 운동 법칙을 밝혀냈다. 이처럼 이미 존재하는 관측값을 새로운 시각으로 해석하는 작업은 과학적 진보를 이끄는 강력한 원동력이 된다. 최근 십여 년 동안 단일세포 전사체학이나 공간 오믹스 같은 첨단 기술이 등장하면서 연구자들은 과거에는 상상하기 힘들었던 복잡하고 거대한 생물학적 데이터를 얻게 되었다. 전 세계의 공공 저장소와 개방형 데이터 플랫폼을 통해 수많은 데이터가 공유되고 있지만, 막상 이를 소화하고 해석하는 속도는 데이터가 쌓이는 속도를 따라가지 못하고 있다.  실제로 방대한 공공 오믹스 데이터를 대상으로 한 조사에 따르면, 공개된 데이터 중 단 몇 퍼센트만이 최소한 한 번이라도 재분석을 거친 것으로 나타났다. 이는 수많은 고품질 데이터가 학술 생태계에 잠들어 있으며, 그 안에 숨겨진 잠재력이 아직 제대로 발현되지 않았음을 보여준다. 인공지능을 활용한 데이터 재분석의 메커니즘과 장점 데이터 재분석은 이미 출판된 데이터를 새로운 연구 질문에 적용하고, 과거의 결론을 재평가...

데이터베이스를 붙인 AI는 헛소리를 얼마나 덜 하나…환각률 최대 90% 이상 줄인 방법의 효과

이미지
생성형 AI가 추천한 정보를 어디까지 믿어도 될까. 대화형 AI는 그럴듯한 답을 만들어내는 데 뛰어나지만, 실제로 존재하지 않는 제품이나 서비스를 추천하는 이른바 '환각(hallucination)' 문제가 꾸준히 지적돼 왔다. 특히 기업이나 연구기관처럼 정해진 목록 안에서만 답해야 하는 환경에서는 이런 오류가 치명적이다. 불가리아 소피아공과대학교 연구진은 이러한 문제를 줄일 수 있는 시스템 구조를 시험했다. 핵심은 AI 자체를 새로 학습시키는 것이 아니라, 검증된 데이터베이스를 기반으로 답하도록 설계했을 때 환각이 얼마나 줄어드는지를 확인하는 것이었다. 연구 결과는 국제학술지 AI 에 발표됐다. AI가 틀린 이유는 '없는 도구를 추천했기 때문' 이번 연구는 일반적인 사실 오류를 측정하지 않았다. 연구진은 전자설계(EDA) 분야의 공학 소프트웨어 82개를 검증된 목록으로 구축한 뒤, AI가 이 목록에 없는 도구를 추천하는 경우를 '환각'으로 정의했다. 여기에는 두 가지 경우가 포함된다. 실제로 존재하지 않는 가상의 소프트웨어를 만들어내는 경우와, 실제 상용 프로그램이지만 연구진이 구축한 데이터베이스에는 등록되지 않은 프로그램을 추천하는 경우다. 즉, 이 연구에서 측정한 환각은 '사실이 틀렸다'기보다 '허용된 목록을 벗어났다'는 의미에 가깝다. 따라서 연구 결과는 폐쇄형 추천 시스템에서의 신뢰성을 평가한 것으로 이해해야 한다. 세 가지 장치를 함께 적용하자 환각률이 크게 감소했다 연구진은 모두 6912회의 API 호출을 수행하며 세 가지 방법을 조합해 비교했다. 첫 번째는 데이터베이스에서 관련 정보를 미리 불러와 AI에게 제공하는 방식이다. 두 번째는 추천 가능한 도구 이름을 검증된 목록으로 제한하는 것이다. 세 번째는 답변을 자유로운 문장이 아니라 일정한 JSON 형식으로 출력하도록 강제했다. 아무런 제약이 없는 상태에서는 데이터...