제품 개요
无问芯穹이란 무엇인가요?
Infinigence AI는 Infini-AI 이기종 클라우드 플랫폼을 운영하는 중국 선도 AI 인프라 기업입니다. 이 플랫폼은 혁신적인 'MxN' 인프라 패러다임을 통해 다양한 AI 모델과 여러 칩 타입을 연결하여, 이기종 칩 간 대형 모델 알고리즘의 효율적 협업 배포를 실현합니다. 플랫폼은 AI Studio(PaaS) 개발 환경 및 분산 학습, GenStudio(MaaS) 모델 추론 및 파인튜닝, 이기종 클라우드 관리 등 세 가지 핵심 서비스를 제공합니다. AMD, Huawei Ascend, NVIDIA 및 중국산 칩 등 10종 이상의 칩과 20개 이상의 주류 모델을 지원하며, 모델 개발부터 배포까지 전 주기에 걸쳐 네이티브 툴체인과 함께 비용 효율적이고 고성능의 컴퓨팅 자원을 제공합니다.
주요 기능
이기종 칩 통합
AMD, Huawei Ascend, NVIDIA 및 중국산 칩 등 10종 이상의 칩 타입을 지원하며, 다양한 하드웨어 아키텍처에서 통합 배포 및 최적화를 제공합니다.
대규모 분산 학습
세계 최초로 단일 작업에서 1,000장 이상의 이기종 칩 혼합 학습을 지원하며, 최대 10,000장까지 확장 가능하고 클러스터 활용률은 최대 97.6%에 달합니다.
종합 AI 개발 도구 세트
통합 개발 환경, 분산 학습 작업, 추론 서비스를 제공하며, 사전 구성된 프레임워크와 장애 복구 기능을 갖추고 있습니다.
멀티모달 모델 서비스
GenStudio 플랫폼을 통해 대형 언어 모델, 텍스트-이미지, 텍스트-비디오 생성 등 다양한 모델에 대한 API 접근을 제공합니다.
기업용 자원 관리
테넌트 기반 자원 관리로 전용 자원 풀, 탄력적 확장, 종합 모니터링 및 과금 시스템을 지원합니다.
사용 사례
- 대형 모델 학습 : 기업은 분산 이기종 컴퓨팅 자원을 활용하여 수십억 파라미터 모델을 원클릭 배포 및 자동 장애 복구와 함께 학습할 수 있습니다.
- AI 애플리케이션 개발 : 개발자는 GPU가 사전 장착된 컨테이너형 Linux 인스턴스와 개발 도구 체인을 활용하여 AI 애플리케이션을 구축 및 배포할 수 있습니다.
- 모델 추론 서비스 : 조직은 여러 컨테이너에 걸친 부하 분산을 통해 확장 가능한 추론 서비스를 배포하여 프로덕션 AI 애플리케이션을 운영할 수 있습니다.
- 멀티모달 콘텐츠 생성 : 기업은 표준화된 API를 통해 텍스트, 이미지, 비디오 생성 기능을 애플리케이션에 통합할 수 있습니다.
- 연구 및 실험 : 학술 기관 및 연구팀은 유연한 자원 할당으로 다양한 컴퓨팅 자원에 접근하여 AI 연구를 수행할 수 있습니다.
자주 묻는 질문
无问芯穹 대안
AIxBlock
탈중앙화, 자체 호스팅 AI 개발 플랫폼으로, 안전하고 비용 효율적인 컴퓨팅 파워, AI 모델, 휴먼 밸리데이터를 제공합니다.
NetMind.AI
분산 AI 컴퓨팅 플랫폼으로 확장 가능한 모델 API, 신속한 배포 및 전 세계 GPU 리소스에 비용 효율적인 접근을 제공합니다.
模力方舟
통합 개발 도구를 갖춘 종합적인 모델 호스팅, 추론, 학습 및 배포 서비스를 제공하는 오픈 소스 AI 플랫폼입니다.
OpenPipe
비용과 지연 시간을 줄이고 정확도를 높이기 위해 맞춤형 대형 언어 모델을 파인튜닝, 호스팅, 관리할 수 있는 개발자 중심 플랫폼입니다.
Unify AI
통합 API 및 동적 라우팅을 통해 대형 언어 모델의 접근, 비교 및 최적화를 간소화하는 플랫폼입니다.
Not Diamond
각 쿼리에 대해 최적의 대형 언어 모델(LLM)을 지능적으로 선택하여 품질을 극대화하고 비용 및 지연 시간을 최소화하는 AI 메타-모델 라우터입니다.
TrainLoop AI
강화학습 기반 추론 모델 파인튜닝을 제공하는 관리형 플랫폼으로, 도메인 특화 및 신뢰성 높은 AI 성능을 실현합니다.
Predibase
초고속·저비용으로 오픈소스 소형 언어 모델 파인튜닝 및 배포를 전문으로 하는 차세대 AI 플랫폼입니다.

