MARKETS
KOSPI
KOSDAQ
S&P 500
NASDAQ
USD/KRW
BTC
NIKKEI
WTI
KOSPI
KOSDAQ
S&P 500
NASDAQ
USD/KRW
BTC
NIKKEI
WTI
Wittgenhaus

2026년 9월 8일 화요일

AI 시대, 당신을 더욱 스마트하게

TOPIC

생성형 AI

생성형 AI 관련 콘텐츠 181건입니다. 주장과 팩트를 분리하고 검증 단계를 표기했습니다.

RESOURCE2SKILL: 인간의 멀티모달 자원을 소프트웨어 에이전트 기술로 변환하는 프레임워크

미검

RESOURCE2SKILL은 튜토리얼 영상, 코드 저장소 등 인간이 만든 멀티모달 자원을 소프트웨어 에이전트가 실행 가능한 기술로 추출하는 새로운 프레임워크입니다. 이 기술은 에이전트의 작업 수행 능력을 기존 대비 11.9%포인트 향상하며 소프트웨어 자동화의 효율성을 높입니다.

AI·48일 전

알리바바 Qwen-Audio-3.0-TTS-Plus 음성 합성 리더보드 1위 달성

검증

알리바바의 신규 음성 합성 모델 Qwen-Audio-3.0-TTS-Plus가 아티피셜 애널리시스 스피치 아레나에서 1위를 차지했습니다. 다국어 지원과 자연스러운 감정 표현 기능을 앞세워 글로벌 시장 공략에 나섭니다.

AI·48일 전

알리바바, 오픈 웨이트 모델 Qwen 3.8 공개와 성능 전략

미검

알리바바가 최신 오픈 웨이트 모델인 Qwen 3.8을 공개했습니다. 이 모델은 2.4조 개의 파라미터를 갖춘 멀티모달 모델로 생산성 도구 시장 공략을 목표로 합니다.

AI·50일 전

엔비디아-허깅페이스, 확산 모델 미세조정 협력 강화

검증

엔비디아와 허깅페이스가 대규모 확산 모델의 효율적인 학습을 위해 기술 협력을 진행합니다. 양사는 NeMo Automodel 라이브러리를 통합하여 개발자에게 최적화된 미세조정 환경을 제공합니다.

AI·52일 전

비디오 이해의 새로운 표준, 완전 공개형 MLLM 'VideoChat3' 등장

미검

VideoChat3는 효율성과 범용성을 동시에 갖춘 완전 공개형 비디오 멀티모달 대규모 언어 모델입니다. 40억 개의 파라미터만으로 기존 대형 모델을 능가하는 성능을 입증하며 비디오 이해 기술의 새로운 지평을 열었습니다.

AI·52일 전

Boogu-Image-0.1, 저비용 고성능 멀티모달 모델 공개

미검

Boogu-Image-0.1 연구진은 오픈소스 통합 멀티모달(multimodal) 이해 및 생성 모델을 공개했습니다. 이 모델은 제한된 컴퓨팅 자원 아래에서도 고품질 텍스트-이미지 생성, 빠른 추론, 지시 기반 편집, 그리고 이중 언어 텍스트 렌더링에서 경쟁력 있는 성능을 보입니다. 특히 선두적인 비공개 모델에 근접하는 결과를 저비용으로 달성했습니다.

AI·53일 전

검색 엔진 도메인 데이터의 생성형 AI 답변 반영 분석

미검

검색 엔진이 축적한 도메인 평판 데이터가 생성형 AI의 답변 생성 과정에 미치는 영향을 분석합니다. 기존 검색 시스템의 기록이 AI 환경에서도 핵심 기반으로 작동하는 원리를 설명합니다.

마케팅·53일 전

Thinking Machines의 1조 파라미터 멀티모달 모델 Inkling 공개

검증

Thinking Machines가 1조 개의 파라미터를 갖춘 대규모 멀티모달 모델 Inkling을 발표했습니다. 텍스트와 이미지, 오디오를 동시에 처리하며 복잡한 추론 작업에 최적화했습니다.

AI·54일 전

구글 검색 내 AI 이미지 생성 기능 도입 및 이미지 검색 개편

검증

구글이 검색 결과 페이지에서 직접 이미지를 생성하는 기능을 새롭게 선보입니다. 이와 함께 이미지 검색 서비스의 홈 화면을 개인화된 갤러리 형태로 개편합니다. 이번 변화는 사용자의 검색 경험을 시각적 콘텐츠 중심으로 확장하려는 전략입니다.

AI·55일 전

아마존 노바 액트 기반 사용자 경험 테스트 자동화 솔루션

검증

아마존 노바 액트를 활용하여 사용자 경험 테스트의 확장성과 유지보수 효율을 높입니다. 멀티모달 모델의 시각적 추론 능력을 통해 인터페이스 변화에 유연하게 대응하는 자동화 환경을 구축합니다.

AI·55일 전

다른 주제