\

전체 글 90

최근 AI 논문 3편으로 보는 설명가능성·안전성·도메인 적용의 흐름

# 최근 AI 논문 3편으로 보는 설명가능성·안전성·도메인 적용의 흐름최근 arXiv에 공개된 논문들을 보면, AI 연구의 관심이 단순한 성능 경쟁을 넘어 설명가능성, 안전성, 그리고 실제 도메인 적용으로 넓어지고 있다는 점이 드러난다. 이번 글에서는 도시 지역 프로파일링을 위한 「Multi-Agent Collaborative Reasoning with Tool-Augmented Evidence for Urban Region Profiling」, 강화학습 에이전트 설명을 다룬 「Explaining Reinforcement Learning Agents via Inductive Logic Programming」, 연합학습과 설명가능 AI의 접점을 정리한 「Federated Explainable Artific..

인컨텍스트 강화학습과 비정상성: 에이전트는 어떻게 맥락만으로 적응하는가

# 인컨텍스트 강화학습과 비정상성: 에이전트는 어떻게 맥락만으로 적응하는가arXiv에 공개된 "In-Context Reinforcement Learning under Non-Stationarity: A Survey"는 비정상적 환경에서 인컨텍스트 강화학습(ICRL)을 어떻게 이해할지 정리한 서베이입니다. 이 글이 다루는 중심 문제는, 사전학습되거나 미세조정된 의사결정 모델이 테스트 시점의 파라미터 업데이트 없이도 상호작용 맥락만으로 잠재적 과제 규칙을 추론하고 이후 행동을 더 잘 조정할 수 있는가입니다. 서베이는 decision-pretrained transformers, algorithm distillation, long-context meta-RL, retrieval-augmented agents의 ..

2026년 LLM 연구 동향: 검색 에이전트, RL 학습, 내부 표현과 추론 스케일링

# 2026년 LLM 연구 동향: 검색 에이전트, RL 학습, 내부 표현과 추론 스케일링최근 arXiv에 올라온 LLM 논문들을 보면, 성능 개선의 초점이 하나의 방법으로 수렴하기보다 몇 가지 뚜렷한 연구 축으로 나뉘고 있다. 한쪽에서는 검색 에이전트가 고정된 시연 데이터가 아니라 자기 경험을 통해 더 나아지도록 학습 환경과 self-distillation을 설계하고, 다른 쪽에서는 RL 과정에서 토큰별 보상 할당이 잘못될 때 생기는 실패 모드를 다룬다. 또 다른 흐름은 모델의 최종 출력이나 chain-of-thought만 보지 않고 내부 표현을 통해 calibration과 faithfulness를 읽어내려 하며, 마지막으로는 이미 강한 모델의 backbone을 그대로 둔 채 토큰당 계산을 늘려 추론 능..

멀티모달 감정 분석과 스파스 어텐션: 최근 논문 2편으로 보는 핵심 아이디어

# 멀티모달 감정 분석과 스파스 어텐션: 최근 논문 2편으로 보는 핵심 아이디어이번 글에서는 최근 arXiv에 공개된 두 편의 논문을 함께 살펴본다. 첫 번째는 음성에서 긍정·부정 감정을 인식하는 문제를 다루며, 오디오 정보와 생성된 다국어 전사를 교차 모달 트랜스포머로 통합하는 접근을 제안한다. 두 번째는 자전거 공유 시스템 같은 미시 모빌리티 환경에서 정류장 단위 수요를 예측하기 위해 Spatio-Temporal Agent Graph Transformer, 즉 STAGformer를 제안한 연구다. 두 논문은 서로 다른 문제를 다루지만, 복잡한 정보를 더 효율적으로 결합하고 모델링하려는 공통된 문제의식을 보여준다. [S1] [S2]intro: 논문 이름과 발표 맥락 소개S1은 "Audio Sentime..

멀티모달 우울증 탐지부터 장기 문맥 언어모델까지: 최근 AI 논문 3편 핵심 정리

# 멀티모달 우울증 탐지부터 장기 문맥 언어모델까지: 최근 AI 논문 3편 핵심 정리이번 글에서는 최근 arXiv에 올라온 세 편의 AI 논문을 간단히 살펴본다. 대상은 멀티모달 우울증 탐지를 다루는 "Uncovering Latent Depression Severity for Binary Depression Detection via Advantage-weighting Ranking", 장기 문맥 처리를 겨냥한 언어모델 "ResonatorLM: Causal Resonant Field Mixing for Efficient Long-Context Language Modelin", 그리고 그래프 디노이징을 스펙트럴 관점에서 해석하는 "Graph Convolutional Attention: A Spectral P..

반응형