TOPIC
생성형 AI
생성형 AI 관련 콘텐츠 181건입니다. 주장과 팩트를 분리하고 검증 단계를 표기했습니다.
구글 노트북LM의 숏폼 영상 요약 기능 도입
검증구글이 인공지능 기반 노트 도구인 노트북LM에 60초 분량의 숏폼 영상 생성 기능을 추가했습니다. 복잡한 정보를 시각화해 정보 접근성을 높이려는 전략입니다. 구독자를 대상으로 우선 배포를 시작했습니다.
이미지 생성 효율 10배 높인 GEAR 모델: 알리바바 그룹 등 공동 연구팀 발표
미검알리바바 그룹을 포함한 공동 연구진이 토크나이저와 생성기를 통합 학습하는 새로운 이미지 합성 프레임워크 GEAR를 공개했습니다. 이 기술은 기존 2단계 학습 방식의 한계를 극복하고 이미지 생성 속도를 10배가량 단축했습니다.
제네시스 분자 AI의 3D 확산 모델 기반 신약 개발 혁신
미검제네시스 분자 AI가 기존 정적 모델링의 한계를 극복한 3D 확산 모델을 통해 신약 개발의 정확도를 높이고 있습니다. 이들은 자율 에이전트 워크플로우를 도입하여 실험 검증 속도를 획기적으로 개선했습니다.
아마존 베드록 에이전트코어의 AG-UI 프로토콜 활용 및 표준화
검증아마존 베드록 에이전트코어는 생성형 AI 에이전트의 복합적인 상호작용을 위해 AG-UI 프로토콜을 도입했습니다. 이 기술은 에이전트와 프론트엔드 간의 통신을 표준화하여 개발 효율성을 높입니다.
구글 나노 바나나 2 라이트와 제미나이 옴니 플래시 출시
검증구글 딥마인드가 개발자를 위한 새로운 멀티미디어 모델 2종을 공개했습니다. 이미지 생성 모델인 나노 바나나 2 라이트와 영상 생성 모델인 제미나이 옴니 플래시를 통해 개발자는 효율적인 콘텐츠 제작 환경을 구축할 수 있습니다.
아시아 AI 스타트업의 독자 모델 개발 가속화와 미국 기술 의존 탈피
검증미국 정부의 앤스로픽 AI 모델 수출 금지 조치가 장기화하면서 아시아 기업들이 독자적인 생성형 AI 모델을 잇달아 선보이고 있습니다. 이는 국가별 AI 인프라를 확보하고 기술 자립을 도모하려는 전략적 움직임으로 풀이됩니다.
바이트댄스 확산 언어 모델 iLLaDA의 성능 분석
미검바이트댄스와 인민대학교 연구진이 개발한 iLLaDA는 확산 방식을 채택한 8B 규모의 언어 모델입니다. 기존 자기회귀 모델과 대등한 성능을 보이며 확산 모델의 가능성을 입증했습니다. 다만 정렬 과정과 추론 안정성 측면에서는 추가적인 개선이 필요합니다.
이미지 생성 모델의 다기능 통합 기술, 댄스OPD(DanceOPD) 개발
미검위저우(Wei Zhou)를 포함한 연구진이 텍스트 기반 이미지 생성과 편집 기능을 통합하는 새로운 프레임워크인 댄스OPD를 발표했습니다. 이 기술은 흐름 매칭 모델에서 각 기능을 효율적으로 학습시켜 생성 품질을 유지하면서도 다중 작업 수행 능력을 극대화합니다.
도메인셔틀: 텍스트 기반 영상 생성의 피사체 재현성과 유연성 확보 기술
미검연구진은 텍스트 프롬프트에 따라 피사체의 특징을 유지하면서도 다양한 도메인으로 영상을 생성하는 도메인셔틀(DomainShuttle) 기술을 발표했습니다. 이 기술은 기존 모델의 한계였던 도메인 간 이동성을 개선하여 영상 생성의 편집 가능성을 높였습니다.
보험업계의 생성형 AI 재난 모델링 도입과 기술적 한계
미검보험업계가 생성형 AI를 도입해 재난 예측 정밀도를 높이고 있습니다. 다만 기술적 환각 현상과 영업 논리에 따른 데이터 왜곡 우려가 제기됩니다. 업계는 AI 데이터의 물리적 타당성을 검증할 엄격한 기준 마련을 서두르고 있습니다.