비전-언어 통합 업그레이드: Qwen3-VL-Flash는 에이전트 제어, 긴 컨텍스트 및 비디오 타이밍 이해를 제공합니다.
알리바바 클라우드는 모델 스튜디오에서 Qwen3-VL-Flash를 출시했습니다. 이 제품은 이미지 및 비디오 이해를 위한 "사고 모드" 및 "비사고 모드" 추론 경로를 모두 제공합니다. 공식 문서에 따르면 Qwen3-VL-Flash 시리즈는 비사고 모드에서 약 260,...
알리바바 클라우드는 모델 스튜디오에서 Qwen3-VL-Flash를 출시했습니다. 이 제품은 이미지 및 비디오 이해를 위한 "사고 모드" 및 "비사고 모드" 추론 경로를 모두 제공합니다. 공식 문서에 따르면 Qwen3-VL-Flash 시리즈는 비사고 모드에서 약 260,...
여러 기술 매체는 The Information의 보도를 인용하여 OpenAI가 웹사이트에서 특정 기업을 대상으로 "Google/Facebook으로 로그인"과 유사한 "ChatGPT로 로그인" 옵션을 홍보하고 있다고 보도했습니다. 이 보도는 또한 파트너가 OpenAI 모...
2025년 10월 17일, Manus는 Manus 1.5를 공식 출시했습니다. 출시 페이지와 변경 내역에 따르면, 버전 1.5는 속도와 안정성을 향상시키기 위한 아키텍처 개편을 특징으로 합니다. 관계자들은 이전 버전에 비해 평균 작업 시간이 크게 단축되었으며, 이로 인...
Kiro는 대기자 명단을 폐지하고 모든 사용자에게 서비스를 제공한다고 발표했습니다. 공식 블로그와 소셜 미디어 계정을 통해 신규 사용자는 "스펙 기반 개발" 및 "바이브 코딩"과 같은 기능을 체험할 수 있는 기간 한정 프로모션을 통해 500포인트를 무료로 받을 수 있다...
Google은 최신 이미지 편집 모델인 Nano Banana를 검색 시나리오에 통합하여 사용자가 Google 앱 내 Lens 및 AI 모드에서 이미지를 생성하거나 편집할 수 있도록 한다고 발표했습니다. 공식 발표와 여러 기술 매체의 보도에 따르면, 사용자는 Androi...
2025년 10월 16일, PaddleOCR은 멀티모달 문서 파싱 모델인 PaddleOCR-VL 출시를 발표했습니다. 이 모델은 버전 3.3.0의 핵심 기능으로 출시되었습니다. 약 0.9B 크기의 이 모델은 NaViT 스타일의 동적 해상도 시각 인코더와 ERNIE-4....