-
RubyLLM: 주요 AI 제공자를 하나로 묶는 Ruby 프레임워크
RubyLLM: 주요 AI 제공자를 하나로 묶는 Ruby 프레임워크 | GeekNews
<ul> <li><strong>RubyLLM</strong>은 Ruby 앱에서 챗봇, AI 에이전트, RAG, 콘텐츠 생성 같은 AI 워크플로를 한 프레임워크로 만들게 해줌</li> <li>GPT, Claude, 로컬 <strong>Ollama</strong> 등을 같은 인터페이스로 다루며, 의존성은 Faraday, Ze…
-
Anthropic, Claude Tag 공개
Anthropic, Claude Tag 공개 | GeekNews
<ul> <li>Claude와 협업하는 새로운 방식으로, <strong>Slack에 팀원처럼 합류</strong>해 채널 내 누구나 작업을 위임할 수 있는 기능</li> <li>지정된 채널 접근 권한과 도구·데이터·<strong>코드베이스 연결</strong>을 통해 <strong>@Claude</strong> 태그만으로…
-
OpenAI, Broadcom과 만든 첫 자체 추론 칩 Jalapeño 공개
OpenAI, Broadcom과 만든 첫 자체 추론 칩 Jalapeño 공개 | GeekNews
<ul> <li><strong>Jalapeño(할라페뇨)</strong> 는 LLM 추론(inference)에 특화된 가속기이자 Broadcom과 함께 만드는 <strong>다세대 컴퓨팅 플랫폼</strong>의 첫 결과물</li> <li>설계 착수부터 제조 테이프아웃까지 단 <strong>9개월</strong> 소요, …
-
VibeThinker-3B: SFT+GRPO로 Opus 4.5 추론 성능을 넘긴 3B 모델
VibeThinker-3B: SFT+GRPO로 Opus 4.5 추론 성능을 넘긴 3B 모델 | GeekNews
<ul> <li><strong>VibeThinker-3B</strong>는 3B 파라미터만으로 검증 가능한 추론을 어디까지 압축할 수 있는지 실험한 소형 밀집 모델임</li> <li>학습 파이프라인은 <strong>Spectrum-to-Signal</strong> 사후학습을 바탕으로 커리큘럼 지도 미세조정, 다중 도메인 …
-
LLM Wiki와 본유적 부하
<p>LLM Wiki 가 유행하고 있는데, 사용에서 가장 크게 우려되는 부분은 PKM 사용시 본유적 부하를 줄이는데에 있다.</p>
-
Mistral OCR 4 공개
Mistral OCR 4 공개 | GeekNews
<ul> <li>Mistral AI가 공개한 <strong>Mistral OCR 4</strong>는 문서에서 텍스트만 뽑는 OCR을 넘어 바운딩 박스, 블록 분류, 인라인 신뢰도 점수까지 함께 반환하는 문서 이해 모델임</li> <li>10개 언어 그룹의 <strong>170개 언어</strong>와 단일 컨테이너 자체…
-
Unlimited OCR — Baidu의 원샷 장문 파싱 모델
Unlimited OCR — Baidu의 원샷 장문 파싱 모델 | GeekNews
<ul> <li><strong>DeepSeek OCR</strong>를 기반으로 디코더의 모든 어텐션을 교체해, 수십 페이지 문서를 <strong>한 번의 순전파(forward pass)</strong> 로 전사하는 E2E OCR 모델</li> <li>핵심은 <strong>참조 슬라이딩 윈도우 어텐션(R-SWA)</str…
-
Moebius: 0.2B 이미지 인페인팅 모델로 10B급 성능 달성
Moebius: 0.2B 이미지 인페인팅 모델로 10B급 성능 달성 | GeekNews
<ul> <li>10B 규모 산업용 파운데이션 모델이 주도하던 고품질 <strong>이미지 인페인팅</strong>을, 파라미터를 2% 미만으로 압축하면서도 동등하거나 그 이상의 품질로 구현한 경량 전문가 모델</li> <li>0.22B(226M) 파라미터로 동작하며, 11.9B 규모의 <strong>FLUX.1-Fill…
-
AI 에이전트를 내 걸로 만드는 방법
AI 에이전트를 내 걸로 만드는 방법 | GeekNews
<p>AI 코딩 에이전트랑 매일 작업하는 개발자라면 이 기분 안다.</p> <p><strong>어제 분명히 우리가 같이 정한 컨벤션인데, 새 세션 열면 백지다.</strong> 내가 TypeScript에서 항상 interface 말고 type 쓰는 거, PR 리뷰에서 저 패턴 별로라고 했던 거, 지난주에 겨우 잡은 그 버…
-
취업과 소프트웨어는 망했다
취업과 소프트웨어는 망했다 | GeekNews
<ul> <li><strong>AI가 증폭시킨 최악의 채용 시장</strong>이 만들어져, 규칙을 지키는 지원자일수록 불리해지는 구조로 바뀌고 있음</li> <li>Coderpad, HackerRank, AI 감독관 시험 등 <strong>초기 필터</strong>는 화면을 잠가 API 레퍼런스 접근을 막지만, 휴대폰으…
-
Claude Code의 "Extended Thinking" 출력 텍스트는 실제 추론이 아님
Claude Code의 “Extended Thinking” 출력 텍스트는 실제 추론이 아님 | GeekNews
<ul> <li>Claude Code는 세션을 디스크에 기록하지만, 로컬 로그의 <strong>thinking block</strong>에는 실제 추론 텍스트 대신 600자 길이의 <code>signature</code>만 남아 있었음</li> <li>Claude의 추론은 <strong>signature로 암호화</str…
-
GLM-5.2를 로컬에서 실행하는 방법
GLM-5.2를 로컬에서 실행하는 방법 | GeekNews
<ul> <li><strong>744B 파라미터</strong>와 40B 활성 파라미터, <strong>1M 컨텍스트</strong> 윈도우를 갖춘 Z.ai의 새 오픈 모델로, 롱 호라이즌 코딩·추론·에이전트 작업에서 SOTA 성능 제공</li> <li><strong>Unsloth Dynamic GGUF</strong>를…
-
Codex 로깅 버그가 로컬 SSD에 TB 단위 쓰기를 발생시켜 SSD 수명을 빠르게 소모
Codex 로깅 버그가 로컬 SSD에 TB 단위 쓰기를 발생시켜 SSD 수명을 빠르게 소모 | GeekNews
<ul> <li>Codex가 로컬 <strong>SQLite 피드백 로그 DB</strong>에 지속적으로 대량 데이터를 기록하며, 한 사용자 환경에서 21일 가동 후 메인 SSD에 약 <strong>37TB</strong>가 기록됨</li> <li>이를 환산하면 연간 약 <strong>640TB</strong>, 1TB…
-
요즘 작품 이미지의 LLM 학습 방해 방법은?
요즘 작품 이미지의 LLM 학습 방해 방법은? | GeekNews
<ul> <li>한 사용자는 아내가 자신의 <strong>작품 이미지</strong>가 LLM 학습에 쓰이는 것을 원치 않아 온라인 공개를 망설이고 있다고 밝힘</li> <li>질문의 핵심은 이미지를 사전에 처리해 <strong>LLM 학습을 방해</strong>하는 라이브러리나 방법이 현재 실용적인지임</li> <li>…
-
GLM 5.2 대 Opus
GLM 5.2 대 Opus | GeekNews
<ul> <li>같은 원샷 프롬프트로 <strong>raw WebGL 3D 플랫폼 게임</strong>을 만들게 하자, Opus는 더 빠르고 완성도 높은 결과를 냈고 GLM-5.2는 낮은 비용과 오픈 가중치라는 장점을 보임</li> <li>GLM-5.2는 Z.ai의 <strong>MIT 라이선스 오픈 가중치</strong…
-
오픈 모델로 갈아타는 데 따른 단점은 크지 않음
오픈 모델로 갈아타는 데 따른 단점은 크지 않음 | GeekNews
<ul> <li>기술 업무에서 <strong>오픈 LLM</strong>은 여전히 성능·호환성·신뢰 비용이 있지만, 최근 격차가 줄어 Claude나 GPT 같은 독점 모델 의존을 낮출 여지가 커짐</li> <li>과거 Linux는 MS Office 호환성, 특수 파일 형식, 미성숙한 오픈소스 생태계 때문에 전문 업무에서 …
-
Show GN: Agent-Blackbox - Claude Code/OpenCode 실행을 세션 맵과 토큰 낭비 분석으로 보는 도구
<p>Claude Code / OpenCode 실행을 로컬에서 기록하고, 세션 맵과 컨텍스트 효율 점수로 보여주는 Agent-Blackbox를 만들었습니다.</p> <p>AI에게 “이 작업에 토큰을 얼마나 쓸 것 같아?”라고 물으면 실제 비용과의 상관관계가 0.39에 불과하다는 연구가 있었습니다.</p> <p>https:…
-
Apertus, 주권 AI를 위한 오픈 파운데이션 모델
Apertus, 주권 AI를 위한 오픈 파운데이션 모델 | GeekNews
<ul> <li>스위스 AI 생태계가 <strong>주권 AI</strong>를 겨냥해 자체 파운데이션 모델 Apertus를 공개하고, EPFL·ETH Zurich·CSCS 협력 기반을 전면에 내세움</li> <li>핵심 차별점은 <strong>오픈 가중치·오픈 데이터·오픈 과학</strong>으로, 학습 데이터와 코드,…
-
NotionTalk | 카카오톡에서 바로 사용하는 Notion 편집/조회 도구(MCP)
NotionTalk | 카카오톡에서 바로 사용하는 Notion 편집/조회 도구(MCP) | GeekNews
<ul> <li>복잡한 설정도, 영어 명령어도 필요 없어요. "오늘 회의록 만들어줘" 한 마디면 NotionTalk이 알아서 페이지를 만들고, 찾고, 정리해요. 카카오톡에서 쓰는 MCP 입니다.</li> <li>이왕 만드는 김에 그냥 Notion SSO 로그인도 지원 합니다. 마침 카카오도 카카오툴즈(카…
-
Show GN: 『내 문장이 그렇게 이상한가요?』에서 영감을 받아 grep으로 대충 훑지 않고 모든 문장을 LLM이 읽고 ...
<p>Claude code나 codex에서 글을 교정하라고 시키면 grep으로 읽어 단어를 빠뜨리곤 합니다.<br /> 그래서 모든 문장을 구분자 단위로 강제로 LLM한테 읽혀서 윤문하는 스킬을 만들어봤어요.</p> <p>im-not-ai 스킬과 『내 문장이 그렇게 이상한가요?』에서 영감을 받아 적의를 가진 것들 등 사람…
-
훈련시킬 수 없는 것
훈련시킬 수 없는 것 | GeekNews
<ul> <li>2026년 중반 투자자들 사이 "AI 정신증"적 절망론이 확산 중이며, 모델이 모든 것을 더 잘하게 되면 그 위에 세워진 회사는 모두 <strong>흡수될 얇은 래퍼</strong>에 불과하다는 논리가 핵심</li> <li>첫 번째 AI SWE였던 Devin은 2024년 표준 벤치마크 과…
-
AI 시대의 프로그래머: 코드 생성에서 비결정성 통제로의 역할 전환
AI 시대의 프로그래머: 코드 생성에서 비결정성 통제로의 역할 전환 | GeekNews
<h3>요약 개요</h3> <ul> <li>AI가 코드 작성의 상당 부분을 자동화하면서 개발자의 핵심 역할은 직접 구현에서 <strong>설계·검증·통제</strong>로 이동하고 있음.</li> <li>프로그래머의 본질은 코드를 많이 입력하는 것이 아니라, 모호한 요구사항의 디테일을 채우고 이를 재사용 가능한 형태로 추…
-
누가 지능의 가격을 정할 것인가?
누가 지능의 가격을 정할 것인가? | GeekNews
<ul> <li>AI가 지능(intelligence)을 <strong>가격이 매겨지는 자원</strong>으로 바꾸면서, 시장의 모든 계층이 그 가격을 누가 통제할지를 두고 경쟁 중</li> <li><strong>AI 랩</strong>들은 사용량이 자신을 거쳐 흐르길 원하고, <strong>애플리케이션</strong>은…
-
Reddit을 이용해 AI 검색을 조작하는 일은 너무 쉽다
Reddit을 이용해 AI 검색을 조작하는 일은 너무 쉽다 | GeekNews
<ul> <li>단 <strong>13단어</strong> 분량의 짧은 텍스트만으로도 ChatGPT와 Google AI 검색을 구동하는 AI 에이전트의 출력을 일관되게 스팸·스캠 콘텐츠로 바꿀 수 있음</li> <li>Reddit, Wikipedia, Quora, Facebook 같은 <strong>사용자 생성 콘텐츠(U…
-
ponytail - AI 에이전트를 가장 게으른 시니어 개발자처럼 생각하게 만들기
ponytail - AI 에이전트를 가장 게으른 시니어 개발자처럼 생각하게 만들기 | GeekNews
<blockquote> <p>"최고의 코드는 작성하지 않은 코드"<br /> "알죠? <strong>긴 포니테일</strong>에 타원형 안경을 쓴 그 사람. <strong>버전 관리 시스템보다 더 오래 회사에 다닌 사람</strong>. 당신이 코드 50줄을 보여주면, 그는 <strong>아무…
-
opencodex — Codex에서 아무 LLM이나 쓸 수 있는 로컬 프록시
opencodex — Codex에서 아무 LLM이나 쓸 수 있는 로컬 프록시 | GeekNews
<p>Codex는 OpenAI 모델만 된다. Claude 쓰고 싶으면? GLM-5.2로 코딩하고 싶으면? OpenAI가 추가해줄 때까지 기다려야 한다.</p> <p>opencodex는 이 문제를 푸는 로컬 프록시다. Codex와 LLM 프로바이더 사이에 끼어서 프로토콜을 실시간으로 번역한다. 스트리밍, 도구 호출, 추론 …
-
Obscure Sorrows의 대규모 표절
Obscure Sorrows의 대규모 표절 | GeekNews
<ul> <li>John Koenig의 <em>The Dictionary of Obscure Sorrows</em>가 별도 도메인에 통째로 재게시되면서, <strong>비공식 사이트</strong>가 원본보다 검색에서 더 잘 보이는 상황이 됨</li> <li>이 사이트는 책의 <strong>311개 신조어</strong>…
-
open-code-review — Alibaba의 AI 코드 리뷰 도구
open-code-review — Alibaba의 AI 코드 리뷰 도구 | GeekNews
<ul> <li>알리바바가 내부에서 사용하던 <strong>AI 코드 리뷰 어시스턴트</strong>로 <strong>2년간 수만 명의 개발자</strong>가 <strong>수백만 건의 코드 결함</strong>을 식별한 뒤 오픈소스로 공개</li> <li>Git diff를 읽고 변경 파일을 <strong>도구 사용 에…
-
LLM이 작성한 인시던트 보고서의 미래가 두렵다
LLM이 작성한 인시던트 보고서의 미래가 두렵다 | GeekNews
<ul> <li>인시던트 보고서에서 <strong>LLM은 자료 수집과 정리</strong>를 돕는 데 유용하지만, 보고서 본문까지 맡기면 검증 과정이 약해짐</li> <li>직접 쓰는 과정은 <strong>증거와 설명의 일관성을 확인</strong>하게 만들며, <strong>글쓰기 자체가 이해 부족을 드러내는 장치</…
-
AI가 우리의 능력을 망치고 있는가? 초기 연구 결과는 부정적
AI가 우리의 능력을 망치고 있는가? 초기 연구 결과는 부정적 | GeekNews
<ul> <li>업무 현장에서 <strong>AI 도구</strong> 의존이 커지면서, 의료·컴퓨터과학 등 <strong>숙련이 중요한 분야</strong>에서 <strong>사람이 쌓은 역량이 약해질 수 있다</strong>는 초기 근거가 나오고 있음</li> <li>폴란드 내시경 전문의 대상 연구에서 AI 미사용 시…