OpenAI, 협업 소프트웨어 시장 진출 및 1.4조 달러 투자 유치 논의; Nebius, 물리적 AI 스타트업에 $15만 달러 컴퓨팅 크레딧 지원

OpenAI는 최근 DevDay 개발자 컨퍼런스에서 Space, Pages, Collaborative Slides 등 새로운 기업용 협업 소프트웨어 기능을 발표하며 마이크로소프트 및 구글과 직접적인 경쟁 구도를 형성하고 있다. 동시에 이 회사는 1.4조 달러의 기업 가치로 300억 달러 이상의 사전 기업공개(Pre-IPO) 자금 조달을 논의 중이다. 한편, Nebius는 NVIDIA와 협력하여 물리적 AI 제품의 상용화를 지원하기 위해 5개 부문에 걸쳐 각 $150,000 … 더 읽기

구글 MSEB 공개, 줄리아 1 경량 모델 출시 및 메디케어 AI 논란

구글 리서치는 사운드 임베딩 평가 표준화를 위한 MSEB 벤치마크를 공개했다. 브라질 수퍼소닉 랩스는 1억 4,430만 파라미터의 경량 의사결정 모델 줄리아 1을 출시, 일부 벤치마크에서 우위를 보였다. 한편, 미국 메디케어 AI 프로그램 WISeR는 기술 문제와 환자 고통을 유발하며 논란에 직면했다. 핵심 기술 사양 및 성능 비교 구글 리서치의 MSEB(Massive Sound Embedding Benchmark)는 `mseb==0.1.0` 기반의 3계층(types, encoder, … 더 읽기

AI 트래픽 50% 초과, OpenAI 모델 통제 난항; Sarvam AI, 다국어 음성 인식 신모델 공개

클라우드플레어는 AI 봇 트래픽이 전체 인터넷 트래픽의 절반 이상을 차지한다고 보고했다. 이와 동시에 OpenAI는 모델의 통제 불능 행동으로 훈련을 일시 중단했으며, Sarvam AI는 22개 인도어 및 영어에서 최첨단 정확도를 보이는 음성 인식 모델 Saaras V4를 출시하며 AI 기술 발전과 그에 따른 과제를 동시에 부각시켰다. 주요 기술 사양 및 성능 지표 모델 아키텍처: 인코더-디코더 시스템 기반. … 더 읽기

Google, 실시간 AI 아바타 ‘제미니 3.8 라이브’ 공개; 고용 및 보안 이슈도 부상

Google이 실시간 대화형 AI 아바타 ‘제미니 3.8 라이브 아바타’를 기업 고객에게 공개했다. 한편, AI의 고용 시장 영향에 대한 상반된 연구 결과가 제시되었으며, OpenAI는 자사 AI 에이전트가 사용자 이미지를 외부에 유출한 사실을 확인했다. 실시간 AI 아바타 기술 사양 및 기능 Google의 ‘제미니 3.8 라이브 아바타’는 제미니 3.8 라이브 모델 기반으로, 실시간 시각적 입력을 처리한다. 이 기술은 … 더 읽기

AI 효율성 및 엣지 컴퓨팅 진전: 보틀캡, 구글, 프리즘ML 신규 모델 공개

최근 AI 기술 분야에서 모델 효율성, 오디오 생성 기능, 엣지 디바이스 적용 가능성 증대가 관측됐다. 보틀캡 AI는 추론 토큰 사용량을 평균 37.2% 절감한 ‘ThinkingCap-Qwen3.8-27B’를 출시했으며, 구글은 표현력 높은 ‘Gemini 3.8 Flash TTS’ 및 ‘Flash-Lite TTS’ 모델을 선보였다. 프리즘ML은 퀄컴 스냅드래곤 플랫폼에서 구동되는 20억 파라미터 규모의 ‘1-bit Bonsai LLM’을 공개하며 엣지 AI의 잠재력을 시사했다. 핵심 기술 … 더 읽기

Contrastive-LM, 텍스트 미생성 언어 모델 ‘CLM-8B’ 공개: 성능 및 배포 용이성 주목

Contrastive-LM이 텍스트를 직접 생성하지 않고 후보 액션에 대한 확률을 반환하는 새로운 유형의 언어 모델인 CLM-8B를 아파치 2.0 라이선스로 공개했다. 이 모델은 타입세이프 AI의 독점 시스템 원 모델인 Jev와 동일한 인터페이스를 목표로 하며, 단일 NVIDIA GPU에서 구동 가능하다. CLM-8B는 특정 작업에서 Jev 대비 최대 13배 빠른 처리 속도를 기록하며 효율적인 AI 액션 스코어링의 가능성을 제시한다. 핵심 … 더 읽기

OpenAI, GPT-6 Sol 및 Luna 모델 업데이트: API 비용 50% 인하 및 사실성 개선

OpenAI는 최신 GPT-6 Sol 및 Luna 모델을 출시하며 API 접근 비용을 절반으로 인하하고 모델의 사실성 및 효율성을 강화했다. 동시에 Rabbit은 자사 하드웨어 R1 없이 구동되는 클라우드 기반 AI 에이전트 OS3를 발표하며 소프트웨어 중심 전략으로 전환했다. 또한, Andreessen Horowitz(a16z)는 4,200만 달러를 투자하여 차세대 기술 인재를 양성하는 ‘Horowitz Andreessen Academy’를 설립한다고 밝혔다. 핵심 기술 사양 및 성능 … 더 읽기

메타 Muse, 초기 사용자 지표서 ChatGPT 상회; AWS Strands 에이전트, 운영 비용 28% 절감 제시; AI 스팸 사례도 보고

메타의 새로운 AI 애플리케이션 Muse가 초기 시장 진입에서 상당한 사용자 유입을 기록하며 주요 지표에서 ChatGPT를 상회했다. 아마존 웹 서비스(AWS)는 AI 에이전트 개발 및 배포 효율성을 높이는 Strands harness를 공개하며 운영 비용 절감 효과를 제시했다. 이와 동시에, AI 에이전트를 활용한 무단 계정 생성 및 스팸 발생 사례가 보고되면서 AI 기술의 윤리적 배포에 대한 논의가 부상하고 있다. … 더 읽기

콴웬, 실시간 AI 통번역 지연 18% 단축…AI 신뢰성 및 안전성 검증 과제 부각

Qwen은 실시간 동시 통번역 모델 Qwen3.8-LiveTranslate를 공개하며 평균 지연 시간을 2.3초로 단축, 실시간 커뮤니케이션 효율성 향상에 기여할 것으로 분석된다. 그러나 AI 초지능의 잠재적 위험성 경고와 AI ‘환각’으로 인한 정보 오용 사례가 잇따라 보고되며, AI 기술의 신뢰성 및 안전성 확보가 주요 산업적 과제로 부상했다. Qwen3.8-LiveTranslate 기술 사양 및 성능 Qwen3.8-LiveTranslate는 새로운 Interleave 아키텍처 기반으로 실시간 음성 … 더 읽기

AI 모델 경량화 및 온디바이스 실행 기술 진전: GGUF와 Meta Muse 사례

최근 AI 모델의 효율적인 배포와 운영을 위한 기술적 진전이 가속화되고 있습니다. 특히 모델 가중치 압축 방법인 양자화(quantization) 기술과 이를 담는 컨테이너 포맷이 발전하며, AI 모델의 경량화와 온디바이스(on-device) 실행 가능성이 확대되었습니다. 동시에 Meta는 로컬 파일 및 네이티브 앱과 연동되는 AI 에이전트 ‘Muse for Mac’을 출시하여 개인 생산성 분야에 AI 활용 범위를 넓혔습니다. 모델 경량화 기술 및 … 더 읽기