Ling 3.0 Flash가 AI Gateway에서 사용 가능합니다
요약
Ant Group의 MoE 모델인 Ling 3.0 Flash가 AI Gateway에서 사용 가능해졌습니다. 256K 컨텍스트 윈도우를 지원하며, 에이전트 추론 및 코딩 워크플로우에 최적화된 성능을 제공합니다.
핵심 포인트
- 124B 파라미터 MoE 모델로 토큰 효율적인 에이전트 추론 지원
- 256K 컨텍스트 윈도우 및 사고/비사고 모드 지원
- AI Gateway를 통해 모델 호출, 비용 추적 및 장애 조치 기능 활용 가능
- 8월 3일까지 3주간 무료 사용 가능
Ant Group의 모델인 Ling 3.0 Flash를 이제 AI Gateway에서 사용할 수 있습니다.
이 모델은 8월 3일까지 향후 3주 동안 무료로 사용할 수 있습니다.
Ling 3.0 Flash는 총 124B(1,240억) 개의 파라미터를 가진 Mixture-of-Experts (MoE) 모델로, 토큰당 약 5.1B(51억) 개의 활성 파라미터를 사용합니다. 256K 토큰의 컨텍스트 윈도우 (Context Window)를 지원하며, 사고 모드 (Thinking mode)와 비사고 모드 (Non-thinking mode)로 동작합니다.
Ling 3.0 Flash는 프로덕션 규모에서 토큰 효율적인 에이전트 추론 (Agentic inference)을 위해 구축되었으며, 다단계 에이전트 실행 과정에서 더 엄격한 토큰, 지연 시간 (Latency), 비용 예산 내에서 더 많은 작업을 수행합니다. 이 모델은 고빈도 에이전트 워크플로우 (Agentic workflows), 코딩 에이전트 (Coding agents), 문서 작업, 그리고 긴 컨텍스트의 다회차 상호작용 (Long-context multi-turn interactions)을 목표로 합니다.
Ling 3.0 Flash를 사용하려면 AI SDK에서 모델을 :inclusionai/ling-3.0-flash-free로 설정하세요.
AI Gateway는 모델 호출, 사용량 및 비용 추적, 그리고 제공업체(Provider) 이상의 가동 시간을 보장하기 위한 재시도 (Retries), 장애 조치 (Failover), 성능 최적화 설정을 위한 통합 API를 제공합니다. 여기에는 맞춤형 보고 (Custom reporting), 데이터 보존 제로 (Zero Data Retention) 지원, API 키 예산 (Budgets for API keys), 라우팅 규칙 (Routing rules) 등이 내장되어 있습니다.
AI Gateway는 추가 마진 없이 제공업체의 가격을 반영하며, Bring Your Own Key (BYOK) 요청을 포함한 추론에 대해 플랫폼 수수료를 부과하지 않습니다.
모델 플레이그라운드 (Model playground)에서 Ling 3.0 Flash를 체험해 보세요.
AI 자동 생성 콘텐츠
본 콘텐츠는 Vercel AI의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기