Thinking Machines의 Inkling Small이 이제 AI Gateway에서 사용 가능합니다
요약
Thinking Machines의 Inkling Small 모델이 Vercel AI Gateway에 추가되었습니다. 이 모델은 적은 자원으로도 높은 성능을 내는 범용 모델로, 추론, 에이전트 기반 코딩, 도구 사용에 최적화되어 있습니다.
핵심 포인트
- Inkling Small은 오디오와 이미지 네이티브 추론 능력을 갖춤
- 사고 노력 조절을 통해 품질, 비용, 지연 시간 간의 균형 가능
- 시각적 작업 시 이미지 크롭, 확대, 검사 기능 지원
- Zero Data Retention(ZDR)을 지원하여 보안 및 컴플라이언스 강화
- 코딩 에이전트 및 도구 사용 워크플로우에 비용 효율적
Thinking Machines의 Inkling Small이 이제 AI Gateway에서 사용 가능합니다.
Inkling Small은 작업당 훨씬 적은 컴퓨팅 자원을 사용하면서, 크기는 약 4분의 1 수준임에도 더 큰 Inkling 모델에 필적하는 성능을 보여줍니다. 이는 오디오와 이미지에 대한 네이티브 추론 (native reasoning) 능력을 갖춘 광범위한 범용 모델 (broad generalist)이며, 추론 (reasoning), 에이전트 기반 코딩 (agentic coding), 그리고 도구 사용 (tool use)에서 뛰어난 성능을 유지합니다. 제어 가능한 사고 노력 (Controllable thinking effort)을 통해 최소한의 추론부터 최대한의 추론까지 품질과 비용 및 지연 시간 (latency) 사이의 균형을 맞출 수 있습니다.
시각적 작업의 경우, 프로그래밍 방식으로 이미지를 자르고(crop), 확대(zoom)하고, 검사(inspect)할 수 있어 관련 세부 정보가 작은 문서나 차트 작업에 도움이 됩니다.
Inkling을 사용하려면 AI SDK의 :model을 thinkingmachines/inkling-small로 설정하세요.
Inkling-Small은 Zero Data Retention (ZDR)과 호환됩니다. 대시보드에서 팀 전체에 적용하거나, 요청 시 zeroDataRetention: true를 사용하여 활성화할 수 있으며, AI Gateway는 각 요청 후 프롬프트와 응답을 삭제하는 제공업체로만 라우팅합니다.
Inkling-Small은 코딩 및 도구 사용 워크플로우를 위한 비용 효율적인 선택이기도 합니다. vercel ai-gateway coding-agents setup을 실행하여 코딩 에이전트를 AI Gateway에 연결한 다음, 에이전트의 모델 구성에서 thinkingmachines/inkling-small을 선택하세요. 자세한 내용은 coding agents guide를 참조하세요.
AI Gateway는 제공업체의 가격을 마진 없이 반영하며, Bring Your Own Key (BYOK) 요청을 포함한 추론에 대해 플랫폼 수수료를 부과하지 않습니다. model playground에서 Inkling Small을 사용해 보세요.
AI 자동 생성 콘텐츠
본 콘텐츠는 Vercel AI의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기