직접 GenAI API
LLM, VLM 또는 ASR 모델이 애플리케이션과 동일한 프로세스에서 실행될 때 Neat의 직접 GenAI API를 사용합니다. 배포된 LLiMa 모델 디렉터리를 로드하고, GenerationRequest를 생성한 다음, 완전한 결과가 나올 때까지 기다리거나 결과가 생성되는 대로 토큰을 스트리밍합니다.
브라우저, 서비스 또는 원격 클라이언트가 HTTP를 통해 모델을 호출해야 하는 경우 대신 GenAI 서버를 사용합니다. 두 애플리케이션 경계 중에서 선택하는 방법에 대한 도움은 GenAI 모델 개요를 참조하십시오.