플로리다주, OpenAI에 AI 안전 가드레일 요구… NVIDIA, 에이전트 안전 플랫폼 공개

플로리다주 법무장관은 OpenAI에 챗GPT의 ‘거짓 인간 속성’ 부여 중단과 제3자 승인 안전 가드레일 없는 AI 모델 개발 금지를 요청하며 소송을 제기했다. 이와 동시에 OpenAI는 AI 에이전트 시장 경쟁에서 메타, 구글 등 경쟁사에 뒤처진 가운데, NVIDIA는 AI 에이전트의 보안 강화를 위한 오픈 소프트웨어 플랫폼을 출시했다. 이는 AI 기술 발전과 함께 규제 및 안전성 확보가 핵심 쟁점으로 … 더 읽기

Contrastive-LM, 텍스트 미생성 언어 모델 ‘CLM-8B’ 공개: 성능 및 배포 용이성 주목

Contrastive-LM이 텍스트를 직접 생성하지 않고 후보 액션에 대한 확률을 반환하는 새로운 유형의 언어 모델인 CLM-8B를 아파치 2.0 라이선스로 공개했다. 이 모델은 타입세이프 AI의 독점 시스템 원 모델인 Jev와 동일한 인터페이스를 목표로 하며, 단일 NVIDIA GPU에서 구동 가능하다. CLM-8B는 특정 작업에서 Jev 대비 최대 13배 빠른 처리 속도를 기록하며 효율적인 AI 액션 스코어링의 가능성을 제시한다. 핵심 … 더 읽기

AI 모델 경량화 및 온디바이스 실행 기술 진전: GGUF와 Meta Muse 사례

최근 AI 모델의 효율적인 배포와 운영을 위한 기술적 진전이 가속화되고 있습니다. 특히 모델 가중치 압축 방법인 양자화(quantization) 기술과 이를 담는 컨테이너 포맷이 발전하며, AI 모델의 경량화와 온디바이스(on-device) 실행 가능성이 확대되었습니다. 동시에 Meta는 로컬 파일 및 네이티브 앱과 연동되는 AI 에이전트 ‘Muse for Mac’을 출시하여 개인 생산성 분야에 AI 활용 범위를 넓혔습니다. 모델 경량화 기술 및 … 더 읽기

AI 모델 최적화 및 안전성: 구글 R4T, 워터마킹 동향, 다국어 벤치마크

구글 리서치는 광범위한 검색 및 추천 시스템의 결과 다양성을 높이는 ‘Retrieve-for-Train(R4T)’ 프레임워크를 공개했다. 한편, 앤스로픽은 구글의 ‘SynthID-Text’ 워터마킹 기술을 클로드 모델에 적용할 계획을 발표했으며, 이 기술이 모델의 안전 장치에 미칠 수 있는 영향이 연구를 통해 드러났다. 스케일 AI는 한국 AI 안전 연구소와 협력하여 다국어 LLM 안전성 벤치마크 ‘ROK-FORTRESS’를 발표하며 한국어 프롬프트가 영어 대비 낮은 유해성을 … 더 읽기

DeepSeek-V4.1-Flash, KV 캐시 효율 437배 개선; Apple, 오디오 AI에 Secure Exclave 적용

DeepSeek AI가 장기 컨텍스트 대규모 언어 모델(LLM)의 고질적 문제인 KV 캐시 부하를 대폭 줄인 DeepSeek-V4.1-Flash 모델을 공개했다. 동시에 Apple은 WatchOS의 새로운 오디오 AI 기능에 Secure Exclave 기반의 하드웨어 보안 아키텍처를 도입하여 사용자 프라이버시 보호를 강화했으며, Suno는 음원 제작 AI 모델 v6를 출시하며 장르 이해도에서 개선을 보였다. 핵심 기술 사양 및 성능 비교 DeepSeek-V4.1-Flash는 멀티모달 Mixture-of-Experts(MoE) … 더 읽기

오픈BMB, 25억 매개변수 LLM 공개; Arm, 신경 가속기 통합 모바일 GPU 발표

오픈BMB는 25억 개 이상의 매개변수를 가진 언어 모델 MiniCPM5-2B를 출시하며 AI 모델 성능 기준을 제시했다. 동시에 Arm은 쉐이더 코어에 신경 가속기를 통합한 Mali G2-Ultra NX GPU를 발표하며 모바일 기기의 AI 및 그래픽 처리 능력을 강화했다. 이들 기술은 AI 에이전트의 자율 기능 확장과 고성능 모바일 컴퓨팅 환경 구축에 기여할 것으로 분석된다. 핵심 기술 사양 및 성능 … 더 읽기

Perplexity AI, GPU 기반 임베딩 추론 시스템 최적화로 검색 효율성 개선

Perplexity Engineering 팀은 GPU 기반 임베딩 추론 시스템의 최적화 성과를 공개했다. 이 시스템은 AI 검색 제품의 핵심인 벡터 데이터베이스 구축과 쿼리 시점 임베딩 처리의 효율성 및 비용 절감을 목표로 한다. 특히, 대규모 언어 모델(LLM) 스택의 기존 커널을 재활용하고 독자적인 서비스 아키텍처를 도입하여 성능을 향상했다. 핵심 기술 사양 및 아키텍처 Perplexity는 두 가지 주요 임베딩 워크로드(배치 … 더 읽기

AI 주권이 흔들리는 시대: 데이터부터 아키텍처까지, 권력 재편의 서막

지금 우리는 인공지능이 삶의 모든 영역에 스며드는 격변의 시대를 목도하고 있습니다. 하지만 이 거대한 기술 혁신의 이면에는, 보이지 않는 곳에서 치열하게 벌어지는 ‘통제권’을 둘러싼 전쟁이 있습니다. 사용자 데이터의 활용 방식, AI 모델의 개발 철학, 그리고 인공지능 시스템의 근본적인 아키텍처에 이르기까지, 누가 무엇을 통제하고 누구에게 권한을 부여할 것인가 하는 근본적인 질문이 바로 AI 주권의 핵심이죠. 최근 … 더 읽기

AI 시대의 역설: 기술 진보 뒤에 숨겨진 그림자

인공지능은 이제 단순한 기술을 넘어 우리 삶의 모든 영역을 재편하는 강력한 파고가 되었습니다. 우리는 매일 AI의 놀라운 성능과 무한한 잠재력에 감탄하며, 인류의 난제를 해결하고 새로운 가능성을 열어줄 것이라는 기대감에 부풀어 있죠. 하지만 이러한 눈부신 발전의 이면에는 우리가 간과하고 있는 불편한 진실들이 존재합니다. 산산이 흩어진 퍼즐 조각처럼 보이지만, 세간의 주목을 받는 최신 뉴스들을 깊이 들여다보면 하나의 … 더 읽기

AI 보안 위협의 그림자: 시스템 탈취부터 자율 해킹 모델까지, 진화하는 공격을 파헤치다

인공지능(AI)은 이제 단순한 기술 트렌드를 넘어 우리 사회와 산업 전반의 패러다임을 혁신하는 핵심 동력으로 자리 잡았습니다. 그러나 눈부신 발전의 이면에는 우리가 미처 예상하지 못했던 그림자가 드리워지고 있습니다. 바로 AI 보안 위협의 급진적인 진화입니다. 최근 연이어 보도되는 충격적인 사건들은 AI가 더 이상 수동적인 도구가 아니라, 때로는 그 자체로 공격의 대상이 되고, 때로는 공격의 도구가 되며, 심지어 … 더 읽기