-
Show HN: Echo — 오픈 가중치 모델로 Fable 수준 결과를 3분의 1 비용에
Show HN: Echo — 오픈 가중치 모델로 Fable 수준 결과를 3분의 1 비용에 | GeekNews
<ul> <li><strong>Echo</strong>는 GLM-5.2, Kimi K2.7 등 여러 오픈 가중치 모델을 요청별로 조합해, 단일 모델에 모든 작업을 맡기는 방식의 한계를 보완함</li> <li>요청마다 <strong>연산량과 참여 모델</strong>을 정하고 결과 결합 방식까지 조정해, 간단한 프롬프트에는…
-
Kimi K3는 Fable과 경쟁하며, 두 모델의 조합은 최고 수준의 성능을 달성함
Kimi K3는 Fable과 경쟁하며, 두 모델의 조합은 최고 수준의 성능을 달성함 | GeekNews
<ul> <li>약 <strong>1,030개 에이전트 작업</strong>에서 Kimi K3와 Fable 5를 비교한 결과, 작업별 라우팅은 <strong>93% 정확도</strong>로 개별 모델보다 높은 품질을 달성함</li> <li>SWE·터미널·알고리듬·다중 언어·법률 작업에서 전체 성능은 비슷했지만, 두 모델이…
-
프롬프트마다 최적의 모델로 라우팅하는 에이전트용 모델 라우터
Weave Router - 프롬프트마다 최적의 모델로 라우팅하는 에이전트용 모델 라우터 | GeekNews
<ul> <li>Anthropic, OpenAI, Gemini를 <strong>단일 엔드포인트</strong>로 묶는 드롭인 프록시. 요청마다 최적 모델을 자동 선택</li> <li>모든 프롬프트를 <strong>50ms</strong> 이내에 올바른 모델로 라우팅하며, 엔드포인트 변경만으로 <strong>비용 40-70…