-
프롬프트마다 최적의 모델로 라우팅하는 에이전트용 모델 라우터
Weave Router - 프롬프트마다 최적의 모델로 라우팅하는 에이전트용 모델 라우터 | GeekNews
<ul> <li>Anthropic, OpenAI, Gemini를 <strong>단일 엔드포인트</strong>로 묶는 드롭인 프록시. 요청마다 최적 모델을 자동 선택</li> <li>모든 프롬프트를 <strong>50ms</strong> 이내에 올바른 모델로 라우팅하며, 엔드포인트 변경만으로 <strong>비용 40-70…
-
Kokoro로 로컬 CPU에서 고품질 TTS 실행하기
Kokoro로 로컬 CPU에서 고품질 TTS 실행하기 | GeekNews
<ul> <li>로컬 음성 생성은 이제 <strong>전용 GPU 없이도</strong> 충분히 현실적인 품질을 낼 수 있으며, 예시 환경에서는 GPU를 LLM 추론에 남기고 TTS를 CPU가 처리함</li> <li><strong>Kokoro</strong>는 82M 파라미터 모델이지만 영어, 중국어, 힌디어 등 여러 언…
-
루프 시작하기
루프 시작하기 | GeekNews
<ul> <li>코딩 에이전트에 매 프롬프트를 지시하는 방식 대신, <strong>정지 조건이 충족될 때까지 작업 사이클을 반복</strong>하는 에이전트 운영 패턴으로 전환 중</li> <li>Claude Code 팀은 루프를 <strong>트리거 방식, 정지 방식, 사용 primitive, 적합 작업 유형</stro…
-
30 Papers - 일리야 서츠케버 추천 AI 핵심 논문 목록 요약
30 Papers - 일리야 서츠케버 추천 AI 핵심 논문 목록 요약 | GeekNews
<ul> <li>일리야 서츠케버가 존 카맥에게 추천했다고 알려진 AI 핵심 논문 목록을 바탕으로, 머신러닝 핵심 논문을 초보자가 따라가기 쉽게 모은 사이트</li> <li>목록은 딥러닝, 컴퓨터 비전, 순차 모델링, 어텐션, 트랜스포머, 그래프 신경망, 스케일링 법칙, 정보이론, 복잡성 이론 등 현대 AI의 주요 발전 흐…
-
no-mistakes - git push 할 때 실수를 방지하기
no-mistakes - git push 할 때 실수를 방지하기 | GeekNews
<ul> <li>실제 remote 앞에 <strong>로컬 git 프록시</strong>를 둬서, <code>origin</code> 대신 <code>no-mistakes</code>로 push하면 검증을 거쳐 <strong>깔끔한 PR</strong>을 자동 생성</li> <li>push 시 <strong>일회용 wor…
-
Google, 기후를 위협하는 디지털 비대화의 지수적 경로
Google, 기후를 위협하는 디지털 비대화의 지수적 경로 | GeekNews
<ul> <li>Google의 최신 기후 보고서에서 총 전력 소비가 2024년 <strong>31TWh</strong>에서 2025년 <strong>43TWh</strong>로 뛰며, 생성형 AI 확장이 빅테크의 에너지 수요를 얼마나 빠르게 키우는지 드러남</li> <li>2023~2024년 증가폭 7TWh에 이어 202…
-
sqlite-utils 4.0, 이제 데이터베이스 스키마 마이그레이션 지원
sqlite-utils 4.0, now with database schema migrations
<p>This morning I released <a href="https://sqlite-utils.datasette.io/en/stable/changelog.html#v4-0">sqlite-utils 4.0</a>, the 124th release of that project and the first major ver…
-
30papers.com – Ilya의 30가지 필수 머신러닝 논문, 초보자 친화적 형식
30papers.com – Ilya's 30 essential ML papers, in a beginner friendly format
<p>Article URL: <a href="https://30papers.com/">https://30papers.com/</a></p> <p>Comments URL: <a href="https://news.ycombinator.com/item?id=48819608">https://news.ycombinator.com/…
-
GLM 5.2와 다가오는 AI 추론 마진 붕괴
GLM 5.2와 다가오는 AI 추론 마진 붕괴 | GeekNews
<ul> <li>GLM 5.2는 <strong>오픈 가중치(open weights)</strong> 모델이 Opus·GPT급 에이전트 작업에 근접하면서, 폐쇄형 프런티어 모델의 높은 추론 마진을 압박할 수 있음을 보여줌</li> <li>AI 비용의 쟁점은 한 번 쓰는 학습비보다 수요에 따라 늘어나는 <strong>추론 비…
-
Fable이 reMarkable을 Harry Potter의 Tom Riddle 일기장으로
Fable이 reMarkable을 Harry Potter의 Tom Riddle 일기장으로 | GeekNews
<ul> <li><strong>riddle</strong>은 reMarkable Paper Pro에서 펜으로 쓴 글씨가 잠시 뒤 사라지고, Tom Riddle의 일기장처럼 답변이 손글씨 획으로 다시 쓰였다가 사라지는 앱임</li> <li>동작 흐름은 펜 입력을 받아 2.8초 유휴 후 페이지를 PNG로 확정하고, <stro…
-
AI 시대에 취미가 곧 비즈니스 기회가 되는 이유
AI 시대에 취미가 곧 비즈니스 기회가 되는 이유 | GeekNews
<ul> <li>LLM이 지식노동을 평준화하면서 해자는 "도메인 지식"으로 이동함.</li> <li>개인 맥락 데이터는 LLM 간 쉽게 마이그레이션되므로 해자가 아님.</li> <li>진짜 방어력은 언어화 불가능한 암묵지(tacit knowledge)와 Human-dependency 높은 분야에서 나옴.…
-
저커버그, "AI 에이전트 기술이 기대보다 느리게 발전하고 있다"
저커버그, "AI 에이전트 기술이 기대보다 느리게 발전하고 있다" | GeekNews
<ul> <li><strong>AI 에이전트</strong> 개발 속도가 기대에 미치지 못했으며, 최근 최소 4개월간의 개발 궤적이 예상만큼 <strong>가속화되지 못함</strong></li> <li>올해 초 도입된 대규모 조직 개편이 충분히 "깔끔하지" 못했고, 경영진이 변화 <strong>시점 판…
-
AMD Ryzen AI Halo, $4000(약 600만원) AI 개발 키트
AMD Ryzen AI Halo, $4000(약 600만원) AI 개발 키트 | GeekNews
<ul> <li>로컬 AI 개발 환경을 직접 맞추는 부담을 줄이기 위해, Ryzen AI Halo는 <strong>Ryzen AI Max+ 395</strong> 미니 PC에 ROCm·드라이버·모델·개발 도구를 묶어 제공함</li> <li>단일 구성은 16코어/32스레드 Zen 5 CPU, Radeon 8060S 내장 G…
-
Anthropic이 개발자 호감을 잃는 몇 가지 방법
Anthropic이 개발자 호감을 잃는 몇 가지 방법 | GeekNews
<ul> <li>Anthropic은 Claude 구독을 <strong>자사 도구 중심 체계</strong>에 묶고 제3자 에이전트 사용에 별도 과금을 붙이면서, 개발자가 기대한 구독 가치와 실제 사용 조건 사이의 간극을 키움</li> <li>Claude 구독 사용처는 Claude Code CLI/Desktop, Claud…
-
언어 모델 안의 글로벌 워크스페이스
언어 모델 안의 글로벌 워크스페이스 | GeekNews
<ul> <li>Anthropic은 Claude 내부에 말로 출력되지 않는 개념이 모이는 <strong>J-space</strong>가 있으며, 이 공간이 여러 처리 과정에 공유되는 작업공간처럼 작동한다는 실험 결과를 공개함</li> <li><strong>Jacobian lens(J-lens)</strong> 는 특정 단…
-
GPT-5.6 Sol Ultra는 Codex에 탑재될 것임
GPT-5.6 Sol Ultra는 Codex에 탑재될 것임 | GeekNews
<ul> <li>GPT-5.5 pro가 <strong>Codex에서 제외</strong>된 것은 실책이라고 지적하자 Codex 담당 Tibo가 "<strong>Ultra will be in codex</strong>" 라며 <strong>GPT-5.6 Sol Ultra가 Codex에 탑재</strong>…
-
Ternlight - 브라우저에서 실행되는 7MB 임베딩 모델 (WASM)
Ternlight – 7 MB embedding model that runs in browser (WASM)
<p>Article URL: <a href="https://ternlight-demo.vercel.app/">https://ternlight-demo.vercel.app/</a></p> <p>Comments URL: <a href="https://news.ycombinator.com/item?id=48811644">htt…
-
GLM 5.2와 다가오는 AI 마진 붕괴 (제1부)
GLM 5.2 and the coming AI margin collapse (part 1)
<p>Article URL: <a href="https://martinalderson.com/posts/the-upcoming-ai-margin-collapse-part-1-glm-5-2/">https://martinalderson.com/posts/the-upcoming-ai-margin-collapse-part-1-g…
-
AI 개발 키트, 완벽한 구성 - AMD Ryzen AI Halo
AI Dev Kit, Batteries Included - AMD Ryzen AI Halo | LTT Labs
<p>Article URL: <a href="https://www.lttlabs.com/articles/2026/07/06/amd-ryzen-ai-halo">https://www.lttlabs.com/articles/2026/07/06/amd-ryzen-ai-halo</a></p> <p>Comments URL: <a hr…
-
Show GN: Fable5는 비싸지고, 로컬 GPU는 부족하다: LLM 하나를 Mac & CUDA로 나눠 돌리는 DRIFT
Show GN: Fable5는 비싸지고, 로컬 GPU는 부족하다: LLM 하나를 Mac & CUDA로 나눠 돌리는 DRIFT
<h2>LLM이 개인에게서 멀어지고 있고, DRIFT는 LLM 하나를 여러 개인 기기로 나눠 돌려 이에 맞섭니다.</h2> <p>DRIFT는 하나의 LLM을 여러 개인 기기에 레이어 단위로 나눠 실행하는 오픈소스 프로젝트입니다.</p> <p>요즘 개인 개발자가 AI를 직접 다뤄보려 하면 양쪽 모두 쉽지 않습니다. Fabl…
-
의미가 보이는 프로젝트를 작성하기
의미가 보이는 프로젝트를 작성하기 | GeekNews
<h3>AI 시대의 모델링</h3> <ul> <li>AI 시대에는 코드 한 줄의 값이 압도적으로 저렴해짐</li> <li>그러나 AI는 데이터 모델을 만들지 않는 판단을 하는 데 종종 어려움을 겪음</li> </ul> <h3>TODO 앱 예시</h3> <ul> <li>TODO 앱에 2주 동안만, 인터벌을 가지고 반복되는 …
-
AI 시대, Figma를 다시 생각하다
AI 시대, Figma를 다시 생각하다 | GeekNews
<ul> <li><strong>Config 2026</strong>에서 Figma는 AI 압박에 대응해 캔버스를 코드, 모션, 셰이더, 에이전트 워크플로로 확장하며 생존을 건 승부수를 던지는 중</li> <li>10여 년간 제품 디자인의 기본 작업 공간이었으나, AI가 기획·프로토타이핑·출시 방식을 재편하며 <strong…
-
메모리 아끼면서 Cross Entropy Loss 계산하기
메모리 아끼면서 Cross Entropy Loss 계산하기 | GeekNews
<p>긴 context, 큰 vocab의 LLM 학습에서 LM head + cross entropy가 왜 가장 큰 메모리 소비처 중 하나가 되는지 짚어본 글. 128K context에서는 logits 텐서 하나가 40GB에 육박해서, 모델 weight보다도 커진다.</p> <p>16B 모델을 128K context로 학습…
-
AI 코딩 시대의 개발자 역할 변화: 코딩 실행자에서 맥락·검증·제품화 설계자로
AI 코딩 시대의 개발자 역할 변화: 코딩 실행자에서 맥락·검증·제품화 설계자로 | GeekNews
<h3>요약 개요</h3> <ul> <li> <p><strong>핵심 주장</strong></p> <ul> <li>AI가 코드를 직접 작성·수정·테스트하는 수준에 도달하면서, 개발자의 역할은 단순 코딩 중심에서 <strong>문제 정의, 작업 설계, 검증, 맥락 관리, 제품화 지원</strong>으로 이동하고 있다.</l…
-
GPT-5.6 Sol Ultra가 Codex에 탑재될 예정
GPT-5.6 Sol Ultra will be in Codex
<p><a href="https://x.com/haider1/status/2073695124220006575" rel="nofollow">https://x.com/haider1/status/2073695124220006575</a>, <a href="https://xcancel.com/haider1/status/20736…
-
OpenTag - Slack용 Claude Tag의 오픈소스 대안
OpenTag - Slack용 Claude Tag의 오픈소스 대안 | GeekNews
<ul> <li>Slack 스레드를 읽고 답변하며 도구를 호출해 결과를 대화창에 바로 렌더링하는 <strong>셀프 호스팅 AI 에이전트</strong></li> <li>락인없이 런타임을 소유하며, 원하는 모델을 자신의 도구에 연동 가능</li> <li>CopilotKit의 오픈 SDK인 <strong>@copilotki…
-
더 나은 모델, 더 나빠진 도구
더 나은 모델, 더 나빠진 도구 | GeekNews
<ul> <li>Pi의 edit 도구에서 <strong>Claude Opus 4.8</strong>과 <strong>Sonnet 5</strong>가 <code>edits[]</code> 내부에 스키마에 없는 필드를 덧붙여 호출이 거부됐고, 최신 모델이 특정 도구 스키마를 이전 모델보다 못 따르는 현상이 관찰됨</li> …
-
공장은 그저 방이다
공장은 그저 방이다 | GeekNews
<ul> <li>AI clock 제작 과정을 초등학생에게 보여준 발표는 제조를 멀리서 감탄할 대상이 아니라 누구나 손댈 수 있는 <strong>만들기 과정</strong>으로 다룸</li> <li>아이디어와 놀이에서 출발해 <strong>프로토타이핑</strong>, 디자인, CAD, e-paper 반복본, 브레드보드와 …
-
GPT-5.5 Codex의 추론 토큰 클러스터링이 성능 저하로 이어질 수 있음
GPT-5.5 Codex의 추론 토큰 클러스터링이 성능 저하로 이어질 수 있음 | GeekNews
<ul> <li>OpenAI Codex 이슈 #30364는 <code>gpt-5.5</code> 응답의 <code>reasoning_output_tokens</code>가 <strong>516</strong>, 1034, 1552 같은 고정값에 몰리는 현상이 복잡한 Codex 작업의 품질 저하와 관련될 수 있다고 보고함<…
-
워크스페이스 인스턴스 또는 소비자 계정 간 잠재적 세션/캐시 누출
워크스페이스 인스턴스 또는 소비자 계정 간 잠재적 세션/캐시 누출 | GeekNews
<ul> <li>Claude Code 이슈 #74066에서 Enterprise ZDR 워크스페이스 사용자가 자신의 작업과 무관한 <strong>Minecraft temple</strong> 관련 응답이 세션에 섞였다고 신고하며, 워크스페이스 캐시 격리와 소비자 플랜 간 누출 가능성을 문제 삼음</li> <li>신고 환경은…