본문 바로가기
반응형

오픈소스ai17

업스테이지 '솔라 오픈 2', 글로벌 AI 트렌드 선두권 진입 허깅페이스 트렌드 3위 기록, '주목할 모델' 등재… 국내 기술력 입증경량 거대언어모델(LLM) 시장 경쟁력 확보, 오픈소스 생태계 기여 기대 국내 인공지능(AI) 기술 스타트업 업스테이지(Upstage)가 자체 개발한 경량 거대언어모델(LLM) '솔라 오픈 2(Solar Open 2)'가 글로벌 AI 커뮤니티 허깅페이스(Hugging Face)에서 높은 평가를 받으며 국내 AI 기술의 우수성을 입증했다. 솔라 오픈 2는 허깅페이스 트렌드(Trends)에서 전체 모델 중 3위를 기록했으며, '주목할 모델(noteworthy model)' 목록에 등재되는 쾌거를 달성했다.허깅페이스는 전 세계 AI 개발자와 연구자들이 모델, 데이터셋, 애플리케이션 등을 공유하고 협력하는 대표적인 오픈소스 AI 플랫폼이다... 2026. 7. 28.
딥시크-V4 전격 공개… “GPT-5.5 성능을 10분의 1 가격에” 100만 토큰 컨텍스트·추론 비용 파괴… 글로벌 AI 시장 ‘초저가 가성비’ 전쟁 격화 중국의 AI 스타트업 딥시크(DeepSeek)가 25일 차세대 오픈 소스 모델인 ‘딥시크-V4(DeepSeek-V4)’를 전격 공개하며 글로벌 AI 시장에 가격 파괴 선언을 했다. 전날 오픈AI가 고성능 ‘GPT-5.5’를 발표하며 기술 패권을 강조한 것과 대조적으로, 딥시크는 압도적인 가격 경쟁력과 효율성을 내세워 ‘가성비’ 중심의 시장 재편에 나섰다.이번에 공개된 딥시크-V4는 100만 토큰의 거대 컨텍스트 창(Context Window)을 기본 지원한다. 이는 수만 페이지의 문서를 한 번에 처리할 수 있는 수준이다. 특히 눈길을 끄는 점은 추론 비용이다. 딥시크 측은 “V4 모델의 추론 비용은 경쟁사 유사 성능.. 2026. 4. 25.
Mistral, 오픈소스 음성 생성 모델 공개 텍스트-to-스피치 분야에서 고품질 오픈 모델로 경쟁 가속… “개발자 중심 AI” 선언 프랑스 AI 스타트업 Mistral AI가 2026년 3월 26일(현지시간) 새로운 오픈소스 음성 생성 모델 ‘Mistral Speech’를 공식 출시했다. 이 모델은 기존 상용 TTS(Text-to-Speech) 모델(Google TTS, ElevenLabs, OpenAI TTS 등) 대비 음성 품질과 자연스러움에서 동등하거나 뛰어나면서도 완전 오픈소스로 공개되어 개발자·기업들의 즉각적인 커스터마이징이 가능하다.Mistral은 모델 가중치, 코드, 학습 데이터셋 구성까지 GitHub에 공개했으며, Hugging Face와 연동해 누구나 1클릭으로 로컬·클라우드에서 실행할 수 있도록 지원한다. 특히 다국어(한국어 포함.. 2026. 3. 30.
중국 MiniMax, M2.5 / M2.5 Lightning 공개 오픈소스 MoE 아키텍처로 가격 파괴… 연 1만 달러에 다수 에이전트 운영 가능 중국 AI 스타트업 MiniMax가 2월 12일 M2.5 시리즈를 공개하며 글로벌 LLM 시장의 가격 전쟁을 본격화했습니다. 최고 성능 모델 M2.5는 Claude Opus 4.6과 GPQA·LiveCodeBench·AgentBench 등 주요 벤치마크에서 92~96% 수준의 성능을 기록하면서도 추론 비용은 1/20 수준에 불과하다고 주장했습니다.기술적 핵심은 최적화된 Mixture of Experts(MoE) 아키텍처입니다. 총 1.8조 파라미터 중 활성화되는 파라미터를 220억 개로 제한해 연산 효율을 극대화했으며, 128K 컨텍스트를 지원하면서도 메모리 사용량을 Claude의 1/7로 줄였습니다. 특히 ‘M2.5 Lig.. 2026. 2. 18.
새 AI '문드림 3' 공개... 20억 활성 파라미터로 '경이로운' 성능 MoE 아키텍처로 소비자용 하드웨어에서 구동 가능객체 탐지, 시각 추론, GUI 분석까지... '과소평가된 모델' 평가 새로운 소형 비전 언어 모델(VLM) '문드림 3(Moondream 3)'가 공개되어 주목받고 있다. 이 모델은 총 90억 개의 파라미터를 가졌지만, 전문가 혼합(MoE) 아키텍처를 사용해 실제 활성 파라미터는 20억 개에 불과하다. 작은 크기에도 불구하고 "현재 최고의(goated) 모델 중 하나"이자 "경이로운" 성능을 보여준다는 평가다.문드림 3는 소비자용 하드웨어에서도 실행할 수 있을 만큼 가벼운 것이 특징이다. 허깅페이스(Hugging Face)를 통해 모델에 접근할 수 있으나, 전용 토큰을 사용한 접근 승인이 필요하다. 라이선스 측면에서는 상업적 이용은 가능하지만, 모델 자체.. 2025. 11. 16.
알리바바, Qwen3 컴팩트 멀티모달 모델 공개…GPT-4o 등과 경쟁 30억 활성 파라미터로 고성능 발휘, 수학·이미지 인식·에이전트 제어 강화FP8 버전 포함하여 오픈소스로 제공…HuggingFace, GitHub 등에서 이용 가능 중국 기술 대기업 알리바바(Alibaba)의 AI 연구 조직인 Qwen 팀이 'Qwen3-Omni' 계열의 새로운 소규모 멀티모달 모델 두 가지를 오픈소스로 공개했다. 이 모델들은 각각 30억 개의 활성 파라미터(3B active parameters)를 가졌음에도 불구하고, 대규모 모델인 GPT-4o 및 클로드 3 소네트(Claude 3 Sonnet)와 경쟁할 만한 고성능을 발휘한다고 발표했다. 새롭게 공개된 모델은 Qwen3-VL-30B-A3B-Instruct와 Qwen3-VL-30B-A3B-Thinking 버전이다. Qwen3 컴.. 2025. 10. 5.
반응형