📦제품미니맥스, 텍스트·오디오 통합 멀티모달 영상 AI 'H3' 공개... "오픈웨이트로 시댄스에 도전"미니맥스가 텍스트, 이미지, 영상, 오디오를 통합 처리하는 멀티모달 영상 생성 모델 'H3'를 공개했다.멀티모달 AI미니맥스H3AI타임스1분 · 약 2개월 전
📦제품블랙 포레스트 랩스, 차세대 영상 모델 '플럭스 3' 출시...독일 블랙 포레스트 랩스가 텍스트 한 줄로 최대 20초 길이의 영상과 오디오를 동시에 생성하는 멀티모달 AI 모델 '플럭스 3'를 공개했습니다.플럭스 3멀티모달 AI영상 생성AI타임스1분 · 약 2개월 전
🔬연구日, 국가 AI 모델 승부수 띄웠다…소니·소프트뱅크·NEC·혼다 주도 '국산 멀티모달 AI' 개발 본격화일본이 소니, 소프트뱅크, NEC, 혼다 등 주요 기업을 중심으로 국가 차원의 멀티모달 AI 기반 모델 개발 프로젝트를 본격화한다.멀티모달 AI일본 AI국가 AI 모델AI타임스KR1분 · 약 2개월 전
📦제품中 시안, 세계 최초 문화관광 특화 멀티모달 LLM '보관' 상용화 확대… AI로 문화유산 보존·관광 혁신 가속중국 시안에서 세계 최초의 문화관광 특화 멀티모달 LLM '보관'이 상용화되어 문화유산 보존과 관광 혁신을 이끌고 있습니다.멀티모달 LLM문화관광AI 혁신AI타임스KR1분 · 3개월 전
📦제품6백만원대 저가형 휴머노이드 로봇 등장…유니트리 'R1'중국 유니트리 로보틱스가 저가형 휴머노이드 로봇 R1의 출고가를 679만원으로 인하하고 즉시 구매 가능하게 전환했습니다.휴머노이드 로봇저가 로봇유니트리전자신문1분 · 3개월 전
📦제품[AI 리뷰] “AI 영상 생성, 이젠 30초”…알리바바, 멀티모달 입력 지원 ‘완3.0’ 공개알리바바 클라우드가 영상 생성 모델 ‘완3.0(Wan3.0)’ 베타 버전을 공개했다.알리바바 클라우드AI 영상 생성멀티모달AI타임스KR1분 · 약 1개월 전
📦제품PPT·엑셀도 영상으로...알리바바, 30초 영상 생성 AI ‘완 3.0’ 공개알리바바가 문서, 스프레드시트, 프레젠테이션 파일을 이해해 최대 30초 분량의 영상을 생성하는 AI 모델 '완 3.0'을 공개했다.알리바바AI 영상 생성완 3.0AI타임스1분 · 약 1개월 전
🔬연구문샷 AI, AI의 '보는 능력'만 측정하는 '퍼셉션벤치' 오픈소스로 공개… "추론보다 시각 인지가 더 큰 병목"중국 AI 스타트업 문샷 AI가 AI의 순수한 시각 인지 능력을 독립적으로 평가하는 벤치마크 '퍼셉션벤치'를 오픈소스로 공개했다.문샷 AI퍼셉션벤치멀티모달 AIAI타임스KR1분 · 약 2개월 전
🧠LLM스위스, 완전 개방형 멀티모달 AI '아페르투스 1.5' 공개…'주권 AI' 인프라 구축 가속스위스가 학습 데이터, 소스코드, 개발 과정까지 모두 공개하는 완전 개방형 멀티모달 LLM '아페르투스 1.5'를 공개했다.아페르투스멀티모달 AI주권 AIAI타임스KR1분 · 약 2개월 전
📦제품삼성, AI 안경 '인텔리전트 아이웨어' 디자인 2종 추가…연내 출시 박차삼성전자가 '갤럭시 언팩 2026'에서 차세대 AI 안경 '인텔리전트 아이웨어'의 신규 디자인 2종을 공개했다.삼성전자AI 안경인텔리전트 아이웨어AI타임스1분 · 약 2개월 전
📦제품구글 비즈, 제미나이 옴니·개인 아바타 탑재로 종합 AI 영상 플랫폼으로 진화구글 비즈가 멀티모달 AI 모델 '제미나이 옴니'와 개인 아바타 기능을 추가하며 AI 영상 제작 경쟁에 박차를 가하고 있습니다.구글 비즈제미나이 옴니AI 영상 제작AI타임스1분 · 2개월 전
📦제품NVIDIA NeMo Automodel과 🤗 Diffusers로 대규모 비디오 및 이미지 모델 미세 조정NVIDIA NeMo Automodel과 Hugging Face의 🤗 Diffusers 라이브러리가 통합되어 대규모 비디오 및 이미지 생성 모델의 미세 조정을 간소화합니다.멀티모달 AI모델 미세 조정생성형 AIHuggingFace1분 · 2개월 전