Laya 진짜 추천합니다. Jev를 오픈소스로 쓰는법
개요 AI 서비스를 만들 때 모든 요청을 최고 성능의 모델에 보내면 비용과 응답 시간이 함께 불어납니다. 이 영상은 요청을 먼저 분류해 알맞은 처리 경로로 보내는 “라우팅” 단계에, 요즘 주목받는 모델 제브 대신 오픈소스 모델 라야를 직접 학습시켜 쓸 수 있는지 실험한 결과를 보여 줍니다. 평범한 M4 프로 맥북, 램 24GB 환경에서 1천 건을 48분 동안 … Read more
핵심만 빠르게, 5분 요약
개요 AI 서비스를 만들 때 모든 요청을 최고 성능의 모델에 보내면 비용과 응답 시간이 함께 불어납니다. 이 영상은 요청을 먼저 분류해 알맞은 처리 경로로 보내는 “라우팅” 단계에, 요즘 주목받는 모델 제브 대신 오픈소스 모델 라야를 직접 학습시켜 쓸 수 있는지 실험한 결과를 보여 줍니다. 평범한 M4 프로 맥북, 램 24GB 환경에서 1천 건을 48분 동안 … Read more
개요 클로드 코드로 에이전트를 돌리다 보면 두 가지 고민이 생깁니다. 토큰 비용이 빠르게 늘고, 단순한 판단 하나에도 기다려야 합니다. 이 영상은 챗GPT 공동 개발자가 내놓은 새 AI 모델 ‘제브’를 소개하고, 제브를 클로드 같은 에이전트 도구와 함께 써서 시스템을 더 빠르고 저렴하게 만드는 방법을 세 단계로 설명합니다. 핵심은 제브가 텍스트를 생성하는 대신 ‘분류’만 하는 모델이라는 점이고, … Read more