-
Echo – 오픈웨이트 모델로 Fable 수준의 결과를 1/3 비용으로 달성
Show HN: Echo – Fable-level results at 1/3 the cost using open-weight models | Hacker News
<p>I’ve been building Echo (<a href="https://echo.tracerml.ai/" rel="nofollow">https://echo.tracerml.ai/</a>), an experiment in making one AI system out of a pool of open-weight mo…
-
OmniRoute — 흩어진 무료/저가 AI 티어를 하나로 묶는 게이트웨이
OmniRoute — 흩어진 무료/저가 AI 티어를 하나로 묶는 게이트웨이 | GeekNews
<ul> <li>하나의 로컬 엔드포인트(<code>localhost:20128/v1</code>)로 <strong>271개 프로바이더/500개 이상 모델</strong>을 연결하고 Claude Code/Codex/Cursor/Cline/Copilot 등 26개 코딩 툴을 설정 하나로 사용</li> <li><strong>9…
-
프롬프트마다 최적의 모델로 라우팅하는 에이전트용 모델 라우터
Weave Router - 프롬프트마다 최적의 모델로 라우팅하는 에이전트용 모델 라우터 | GeekNews
<ul> <li>Anthropic, OpenAI, Gemini를 <strong>단일 엔드포인트</strong>로 묶는 드롭인 프록시. 요청마다 최적 모델을 자동 선택</li> <li>모든 프롬프트를 <strong>50ms</strong> 이내에 올바른 모델로 라우팅하며, 엔드포인트 변경만으로 <strong>비용 40-70…
-
Fable 비용 60% 절감: 코드를 이미지로 변환하고 모델이 OCR하게 하기
Fable 비용 60% 절감: 코드를 이미지로 변환하고 모델이 OCR하게 하기 | GeekNews
<ul> <li><strong>pxpipe</strong>는 Claude Code 요청의 큰 컨텍스트를 로컬 프록시에서 PNG 이미지로 바꿔 입력 토큰을 줄이며, Fable 현재 정가 기준 엔드투엔드 청구액을 약 <strong>59~70% 낮춘다</strong>고 밝힘</li> <li>핵심 원리는 이미지 토큰 비용이 안에…
-
에이전트 코딩에 로컬 LLM 활용하기
에이전트 코딩에 로컬 LLM 활용하기 | GeekNews
<ul> <li>클라우드 플래그십 모델의 가격 급등 속에서, 비용 부담 없이 코딩 작업을 이어갈 수 있는 <strong>로컬 모델 활용법</strong> 정리</li> <li>로컬 모델은 SOTA 모델 성능에 미치지 못하지만 <strong>가격 대비 성능</strong>과 <strong>결정론적 하니스(determinis…