AI 효율성 및 엣지 컴퓨팅 진전: 보틀캡, 구글, 프리즘ML 신규 모델 공개

최근 AI 기술 분야에서 모델 효율성, 오디오 생성 기능, 엣지 디바이스 적용 가능성 증대가 관측됐다. 보틀캡 AI는 추론 토큰 사용량을 평균 37.2% 절감한 ‘ThinkingCap-Qwen3.8-27B’를 출시했으며, 구글은 표현력 높은 ‘Gemini 3.8 Flash TTS’ 및 ‘Flash-Lite TTS’ 모델을 선보였다. 프리즘ML은 퀄컴 스냅드래곤 플랫폼에서 구동되는 20억 파라미터 규모의 ‘1-bit Bonsai LLM’을 공개하며 엣지 AI의 잠재력을 시사했다. 핵심 기술 … 더 읽기

AI 모델 경량화 및 온디바이스 실행 기술 진전: GGUF와 Meta Muse 사례

최근 AI 모델의 효율적인 배포와 운영을 위한 기술적 진전이 가속화되고 있습니다. 특히 모델 가중치 압축 방법인 양자화(quantization) 기술과 이를 담는 컨테이너 포맷이 발전하며, AI 모델의 경량화와 온디바이스(on-device) 실행 가능성이 확대되었습니다. 동시에 Meta는 로컬 파일 및 네이티브 앱과 연동되는 AI 에이전트 ‘Muse for Mac’을 출시하여 개인 생산성 분야에 AI 활용 범위를 넓혔습니다. 모델 경량화 기술 및 … 더 읽기