MARKETS
KOSPI
KOSDAQ
S&P 500
NASDAQ
USD/KRW
BTC
NIKKEI
WTI
KOSPI
KOSDAQ
S&P 500
NASDAQ
USD/KRW
BTC
NIKKEI
WTI
Wittgenhaus

2026년 9월 8일 화요일

AI 시대, 당신을 더욱 스마트하게

TOPIC

AI 연구

AI 연구 관련 콘텐츠 166건입니다. 주장과 팩트를 분리하고 검증 단계를 표기했습니다.

오픈에이아이의 ARC-AGI-3 벤치마크 성능 측정 방식 논란

미검

오픈에이아이가 자사 모델 GPT-5.6 Sol의 성능을 자체 환경에서 측정해 발표했습니다. 하지만 공식 환경에서의 점수와 큰 차이를 보여 성능 평가 기준을 두고 논란이 일고 있습니다.

AI·40일 전

오픈에이아이, API 설정 최적화를 통한 인공지능 추론 성능 향상

검증

오픈에이아이가 특정 API 설정을 조정해 인공지능 모델의 추론 성능을 세 배 높였습니다. 모델 구조를 변경하지 않고도 효율성을 극대화한 이번 성과는 인공지능 개발의 새로운 전략을 제시합니다.

AI·40일 전

앤스로픽 아모데이 CEO의 오픈 웨이트 모델 위험성 경고와 규제 강화 제안

검증

다리오 아모데이 앤스로픽 최고경영자가 오픈 웨이트 모델이 초래할 수 있는 안보 위협을 경고했습니다. 그는 강력한 모델에 대한 의무적인 안전 테스트 도입과 대중국 칩 수출 통제 강화를 촉구했습니다.

AI·41일 전

앤스로픽 다리오 아모데이의 오픈 웨이트 모델 규제 반대 입장 표명

검증

앤스로픽의 다리오 아모데이 최고경영자가 오픈 웨이트 모델 금지에 반대한다는 입장을 밝혔습니다. 그는 모델의 개방성보다 고성능 AI의 안전성 확보와 중국의 기술 탈취 방지가 우선이라고 강조했습니다.

AI·42일 전

앤스로픽 클로드 오퍼스 5의 ARC-AGI-3 벤치마크 신기록 달성

검증

앤스로픽의 클로드 오퍼스 5가 새로운 인공지능 성능 평가 지표인 ARC-AGI-3에서 기존 최고 기록을 경신했습니다. 이 모델은 낯선 환경에서도 높은 추론 능력을 증명하며 차세대 인공지능의 가능성을 제시했습니다.

AI·43일 전

미국 정부의 중국산 오픈 웨이트 AI 모델 선별 규제 검토

미검

미국 정부가 국가 안보를 이유로 중국산 오픈 웨이트 인공지능 모델에 대한 선별적 규제 방안을 검토합니다. 기술 패권 경쟁과 보안 우려가 맞물리면서 오픈 소스 생태계의 향방에 관심이 쏠립니다.

AI·44일 전

교육용 거대언어모델 성능 평가의 새 기준, K12-KGraph 공개

미검

하오 리앙 등 연구진은 초·중·고 교육과정을 체계화한 지식 그래프 K12-KGraph를 발표했습니다. 이를 활용해 교육용 인공지능의 추론 능력을 검증하는 벤치마크와 학습 데이터를 함께 구축했습니다.

AI·44일 전

앤스로픽 클로드 오퍼스 5 출시와 성능 분석

미검

앤스로픽이 지난 2026년 7월 24일 클로드 오퍼스 5를 공식 출시했습니다. 이 모델은 기존 페이블 5 대비 비용 효율성을 높이고 에이전트 작업 능력을 강화했습니다. 벤치마크 점수와 실제 성능 간의 차이에 대한 분석을 정리했습니다.

AI·44일 전

앤스로픽 클로드 오퍼스 5의 성능 및 비용 효율성 분석

미검

앤스로픽이 공개한 클로드 오퍼스 5는 주요 벤치마크에서 경쟁 모델과 대등한 성능을 보입니다. 특히 이전 모델 대비 비용 효율성을 개선하며 시장 경쟁력을 확보했습니다.

AI·44일 전

사카나 AI, 모델 라우터 푸구 울트라 v1.1 공개

미검

사카나 AI가 성능을 개선한 인공지능 모델 라우터 푸구 울트라 v1.1을 발표했습니다. 기존 버전과 동일한 가격을 유지하며 프로그래밍 벤치마크에서 성능 향상을 달성했습니다.

AI·45일 전

다른 주제