AI 4건 · 일반 2건
최근에 발표된 스파크 모델은 중국 오픈 모델에 뒤지지 않는 성능을 보여주고 있다. 이 모델은 현재 공개된 오픈 모델 중에서 가장 좋은 성능을 보이는 모델 중 하나로, 앞으로의 연구와 개발에 큰 기대를 모으고 있다. 스파크 모델은 다른 오픈 모델과 비교했을 때 더 나은 성능을 보여주고 있으며, 이는 앞으로의 연구와 개발에 큰 기대를 모으고 있다. 스파크 모델의 성능은 앞으로의 연구와 개발에 큰 기대를 모으고 있으며, 이는 많은 연구자와 개발자가 이 모델을 사용하게 될 것으로 예상된다.
기존 대규모 언어 모델(LLM)의 작은 모델 학습 기법인 지식 증류는 비용 부담이 컸다. 수백 개의 GPU와 복잡한 병렬 처리 전략이 요구됐기 때문이다. Hugging Face 블로그는 이를 해결할 효율적인 지식 증류 시스템을 소개한다. 이 시스템은 교사의 탑-K 로짓을 캐싱하고 새로운 메모리 효율적인 KL 손실 함수를 사용해 VRAM 사용량을 획기적으로 줄인다. 단일 GPU에서도 장기 문맥 복구 학습이 가능하며, 대규모 실험 비용을 절감한다.
로컬에서 긴 비디오를 이해하는 모델을 개발하는 방법에 대해 논의하고 있다. 기존의 모델은 품질이 떨어지거나 프레임 샘플링이 필요하여 한계가 있다. 따라서 로컬에서 긴 비디오를 이해하는 새로운 모델을 개발하는 것이 필요하다. 이를 위해 mp3 오디오 파일을 전사하고, 전사본을 요약하여 타임스탬프가 있는 vtt 파일을 생성한다. 또한, 동적 프레임 레이트를 계산하고, 프레임을 샘플링하여 변경이 적은 프레임을 제거한다.
Gemini Enterprise Agents 플랫폼을 통해 Claude 모델을 사용할 수 있다. 이는 개발자와 비즈니스 유저에게 강력한 도구를 제공한다. Claude 모델은 자연어 처리와 코드 생성을 위한 강력한 모델로, Gemini 플랫폼을 통해 쉽게 접근할 수 있다. 이는 개발자와 비즈니스 유저가 더 효율적으로 작업할 수 있도록 도와준다. Claude 모델과 Gemini 플랫폼의 조합은 비즈니스와 개발에 큰 기회를 제공한다.
Meta의 새로운 멀티모달 모델 Muse Glimmer가 공개된다. 300억 파라미터 규모로 코딩, 문서 분석, 개인 비서 등 에이전트 활용 사례에 최적화된다. 또한 GraniteMoeSWA 및 GraniteSWA 모델 지원이 추가되어 모델 선택지를 넓힌다. 이번 업데이트는 로컬 환경에서도 프라이버시를 강화한 AI 애플리케이션 구축을 가능하게 한다.
Meta Superintelligence Labs의 첫 오픈 모델인 Muse Glimmer가 Ollama에 출시되었다. 이 30B 멀티모달 모델은 로컬 에이전트 워크로드를 위해 설계되었다. 특히 Apple Silicon 환경에서 Ollama의 MLX 엔진을 통해 최신 성능을 제공하며, DFlash 및 이미지 입력 기능도 포함한다. 이를 통해 개발자는 Claude Code와 같은 코딩 에이전트 및 OpenClaw 같은 개인 비서를 로컬에서 강력하게 구동할 수 있다.