MARKETS
KOSPI
KOSDAQ
S&P 500
NASDAQ
USD/KRW
BTC
NIKKEI
WTI
KOSPI
KOSDAQ
S&P 500
NASDAQ
USD/KRW
BTC
NIKKEI
WTI
Wittgenhaus

2026년 9월 8일 화요일

AI 시대, 당신을 더욱 스마트하게

AI검증

인간 정신 상태 반영한 새로운 인공지능 세계 모델

연구진은 인간의 신념과 의도 등 정신적 상태를 반영하는 새로운 인공지능 세계 모델 프레임워크를 개발했습니다. 해당 프레임워크는 기존 모델 대비 높은 예측 성능을 기록했습니다. 앞으로 인공지능이 인간의 행동을 더욱 정확하게 예측할 것으로 기대됩니다.

2026년 8월 22일

주장현재의 인공지능 세계 모델은 물리적 객체와 움직임만을 다룹니다. 이러한 접근은 인간의 신념이나 의도 같은 정신적 상태를 누락합니다.

주장인공지능은 인간의 정신적 상태를 파악하지 못해 실제 행동을 정확하게 예측하지 못합니다.

팩트연구진은 정신적 변수를 포함한 정신적 세계 모델링 프레임워크를 개발하여 개발자 플랫폼인 깃허브에 공개했습니다.

팩트해당 모델은 신념, 주의력, 목표, 감정, 사회적 규범을 변수로 활용합니다.

팩트모델은 행동의 정신적 의미를 분석합니다.

팩트멘티스 프레임워크는 별도의 훈련이 필요 없는 모듈형 구조로 이루어져 있습니다.

팩트시스템은 장면을 분석한 뒤 물리적 타당성과 정신적 일관성, 그리고 사회적 적절성이라는 세 가지 기준에 따라 행동을 평가합니다.

팩트이 과정은 기계가 읽을 수 있는 중간 결과를 생성합니다.

팩트개발진은 448개의 결정 장면으로 구성된 멘티-벤치 데이터셋을 구축했습니다. 데이터셋의 78퍼센트는 두 명 이상의 인물이 등장하는 복잡한 상호작용 상황을 담고 있습니다.

팩트실험 결과, 정신적 세계 모델링 프레임워크를 적용한 모델은 에프원 점수 87.9점을 기록했습니다. 이는 직접 답변 방식의 63.3점과 자기 일관성 방식의 77.9점을 웃도는 수치입니다. 인간의 성능은 98.5점으로 측정되었습니다.

교차검증단순히 모델의 답변을 여러 번 샘플링하는 방식으로는 정신적 세계 모델링의 성능을 넘어설 수 없습니다. 성능이 가장 낮은 모델이라도 이 프레임워크를 적용하면 직접 답변 방식을 사용하는 가장 강력한 모델보다 더 정확한 예측을 수행합니다.

팩트정신적 모델링은 대인 관계 장면에서 에프원 점수를 26.4점 끌어올렸습니다. 반면 객체 중심의 장면에서는 14.0점 향상에 머물렀습니다.

교차검증현재 인공지능 성능의 병목 현상은 시뮬레이션 단계에서 나타납니다. 물리적 상태와 정신적 상태가 결합된 변화를 예측하는 과정에서 오류가 자주 발생합니다. 연구진은 중간 단계의 예측 정확도를 높이는 것이 개선의 과제라고 밝힙니다.

주장세계 모델의 정의를 두고 학계와 업계의 의견이 엇갈립니다. 오픈에이아이의 소라 같은 생성형 모델을 세계 모델로 볼 것인지, 실제 세계와 상호작용하는 시스템만 인정할 것인지에 대한 기준이 아직 정해지지 않았습니다.

출처더 디코더(https://the-decoder.com/world-models-that-ignore-human-beliefs-predict-the-wrong-actions-new-research-shows/) 및 아카이브 논문을 교차 검증했습니다.

관련 콘텐츠

본 기사는 전문가의 분석과 공개 자료를 기반으로 AI가 작성 후 다른 AI의 검증을 거쳐 작성됐으며 정보의 정확성과 완전성을 보장하지 않습니다. 기사 내용은 특정 투자·의사결정의 권유가 아니며, Wittgenhaus는 이를 근거로 한 행위의 결과에 책임을 지지 않습니다.

스팟

WIRE

버블 지표

상세보기 →

릴리즈 & 논문

전체보기 →

RELEASES

OpenAIv2.53.0

v2.53.0

GPT-5.5 모델 지원 및 Responses 타입에 tool 이름/네임스페이스가 추가되었습니다. CI 관련 버그 수정으로 NumPy 소스 빌드 및 중복 HTTPX 커버리지가 방지되었습니다.

35일 전

OpenAIv2.52.1

v2.52.1

이번 릴리즈에서는 CI(지속적 통합) 관련 변경 사항이 포함되었습니다. 구체적으로 setup-uv v5를 해당 커밋에 고정하는 작업이 진행되었습니다.

35일 전

TensorRTv1.3.0rc23

v1.3.0rc23 릴리즈

이번 릴리즈에서는 DeepSeek V4 혼합 정밀도 NVFP4 체크포인트 로딩, Gemma4 K=V 레이어 W4A8 체크포인트 로딩 지원 등 모델 지원이 강화되었습니다. 또한, VisualGen 모델에 대한 비대칭 TP 선형 구현, 멀티 프로세스 HTTP 프론트엔드 지원 등 API 개선이 이루어졌습니다. GPT-OSS 및 GLM-5의 Python KV-캐시 트랜시버 기본값 설정, MiniMax-M3 MSA 희소 어텐션 백엔드 추가 등 다양한 기능이 추가되었으며, 여러 버그 수정 및 성능 최적화가 포함되었습니다.

38일 전

OpenAIv2.52.0

v2.52.0

이번 릴리즈에서는 API에 콘텐츠 출처 확인 기능이 추가되었습니다. 또한, 클라이언트에서 Retry-After 지연 시간을 최대 2분까지 지원하도록 수정되었으며, API 키 mTLS HTTP 클라이언트 레시피 관련 문서가 업데이트되었습니다.

38일 전

OpenAIv2.51.0

v2.51.0

이번 릴리즈에서는 API에 fast tier 기능이 추가되었습니다. 또한, 해당 fast tier 기능이 헬퍼 메서드에도 적용되었습니다.

39일 전

PAPERS