Techday
‘MoE’ 키워드 기사 8
    image

    노타, EMNLP 2026서 MoE 양자화 논문 2편 채택

    AI 모델 경량화 기업 노타가 EMNLP 2026에서 초거대언어모델 최적화 논문 2편 채택을 확보했다. MoE 양자화 기술로 Qwen 3.8 Max 구동 시 필요한 GPU를 24장에서 4장으로 대폭 축소할 수 있음을 입증했다. 데이터센터 AI 인프라 운영 효율을 높이는…

    2026.08.25 by 배종인 기자

    image

    노타, 문샷AI ‘키미 K3’ 경량화…엔비디아 B300 GPU 8장→4장

    AI 모델 최적화 기업 노타가 문샷AI의 2조8,000억 매개변수 초거대 AI 모델 ‘키미 K3’를 경량화했다. 자체 개발한 비균일 전문가 프루닝 기술을 적용해 필요 GPU를 8장에서 4장으로 절감하면서도 핵심 성능을 유지했다. 이 기술은 층별 특성을 분석해 기여도 낮…

    2026.08.06 by 배종인 기자

    image

    노타, AI 인프라 비용 최대 76.5% 절감…‘솔라 오픈2’ 전용 경량화 모델 공개

    AI 모델 경량화 전문기업 노타가 업스테이지의 정부 독자 AI 파운데이션 모델 솔라 오픈2의 경량화 버전을 공개했다. MoE 양자화와 프루닝 기술을 적용해 가중치 메모리를 76.5% 감축했으며, 필요한 GPU를 8장에서 2장으로 줄였다. 기업의 AI 인프라 비용 절감 …

    2026.07.27 by 배종인 기자

    image

    노타, ICML 2026 챌린지 3위…Qwen 추론 최적화 기술 검증

    AI 모델 경량화 기업 노타(Nota AI)가 국제 머신러닝 학회 ICML 2026의 ‘Efficient Qwen Competition’에서 3위를 차지했다. 양자화와 추측적 디코딩을 결합한 기술로 단일 A10G GPU 환경에서 Qwen3.5-4B의 추론 속도를 평균 …

    2026.07.13 by 배종인 기자

    image

    노타, 국산 NPU서 LG K-엑사원 236B 최적화 성공

    노타가 퓨리오사AI의 데이터센터용 NPU에서 LG의 K-엑사원 236B를 최적화하는 데 성공했다. 모델 크기를 71% 감소시키면서 99.2% 정확도를 유지한 이번 성과는 국산 AI 반도체, 국내 LLM, 최적화 소프트웨어가 연계된 소버린 AI 인프라 구성이 가능함을 보…

    2026.06.30 by 배종인 기자

    image

    노타, ICML 2026 워크샵서 MoE 양자화 연구 2건 발표

    AI 모델 경량화 및 최적화 기술 기업 노타가 ICML 2026 AdaptFM 워크샵에서 MoE 모델 양자화 관련 연구 2건을 발표한다. 노타에 따르면 채택 논문은 DREAM-MoE와 SRA-MoE로, 대규모 AI 모델을 더 적은 메모리와 연산 자원으로 실행하면서 성능…

    2026.06.11 by 명세환 기자

    image

    노타, 엔비디아 ‘네모트론 해커톤’ 종합 1위… 데이터 중심 AI 최적화 가능성 제시

    노타가 엔비디아 네모트론 해커톤에서 종합 1위를 차지했다. 노타는 MoE 구조에 특화된 합성 데이터 생성 기술을 기반으로 양자화 성능을 개선하며 Track C 1위를 기록했고, 전체 참가팀 중 최고 평가를 받았다. 이번 결과는 기존 알고리즘 중심의 모델 최적화 방식에서…

    2026.04.27 by 배종인 기자

    image

    노타, 업스테이지 ‘솔라 오픈 100B’ 양자화 모델 공개…가중치 메모리 191.2GB→51.9GB

    AI 모델 운영비의 핵심 변수인 GPU 메모리 부담을 낮추기 위한 ‘양자화(Quantization)’ 경쟁이 대형언어모델(LLM)로 확산되는 가운데, 노타가 업스테이지의 ‘Solar-Open-100B’를 대상으로 한 양자화 모델을 허깅페이스에 공개했다. 모델 카드에 따…

    2026.03.05 by 배종인 기자