-
GTM을 위한 AI가 성과를 내지 못한 이유 (그리고 해결 방법)
GTM을 위한 AI가 성과를 내지 못한 이유 (그리고 해결 방법) | GeekNews
<ul> <li>이메일 작성, AI SDR, 인텐트 도구 등 다양한 AI를 도입한 <strong>GTM 팀</strong> 대부분이 기대만큼 영업 생산성·파이프라인·매출 향상을 체감하지 못하고 있음</li> <li>AI에 계정 공략을 맡기면 "Acme가 SDR을 채용 중이고 작년 실주 건이 있으니 연락하라&quo…
-
결정과 돈: 회사가 '앤트로픽이 이걸 만든다면?' 질문에서 살아남는 법
결정과 돈: 회사가 "앤트로픽이 이걸 만든다면?" 질문에서 살아남는 법 | GeekNews
<ul> <li>AI 모델이 강력해질수록 소프트웨어 자체의 가치는 떨어지며, 살아남으려는 애플리케이션 회사는 <strong>데이터 회사이자 핀테크 회사</strong>로 동시에 전환 필요</li> <li>에이전트가 소프트웨어의 주된 사용자가 되면서 per-seat 가격 모델이 붕괴, 천 명이 십만 개 에이전트를 돌려도 십…
-
GLM 5.2, Semgrep IDOR 벤치마크에서 Claude 앞서
GLM 5.2, Semgrep IDOR 벤치마크에서 Claude 앞서 | GeekNews
<ul> <li>Semgrep의 <strong>IDOR 취약점 탐지</strong> 벤치마크에서 Zhipu AI의 open-weight 모델 <strong>GLM 5.2</strong>가 단순 프롬프트 조건만으로 Claude Code보다 높은 F1을 기록함</li> <li>실험은 데이터셋·평가 방식·시스템 프롬프트를 고정…
-
Show GN: 아이디어부터 앱스토어까지 — Flutter/Flame 게임 출시 하네스 (Claude Code 플러그인)
<p>Flutter/Flame 게임을 "아이디어 → 기획 → 개발 → QA → 스토어 제출"까지 끌고 가는 Claude Code 플러그인을 오픈소스로 공개합니다.</p> <p>Flame 게임을 직접 여러 개 만들어 스토어에 올리면서, 매번 반복하던 절차와 매번 다시 밟던 함정을 하네스로 코드화했습니다. …
-
AI 슬롭과 온라인 소음에 대한 최고의 답은 Robin Williams에게서 나온다
AI 슬롭과 온라인 소음에 대한 최고의 답은 Robin Williams에게서 나온다 | GeekNews
<ul> <li><em>Good Will Hunting</em>의 벤치 장면은 <strong>책으로 아는 지식</strong>과 직접 살아낸 경험의 차이를 통해 AI 슬롭·무한 조언·온라인 소음이 놓치는 것을 보여줌</li> <li>AI는 인터넷을 읽었지만 <strong>상황을 읽거나 삶을 살아본 적이 없고</strong…
-
아시아 AI 스타트업들, Anthropic Mythos 대체 모델 출시
아시아 AI 스타트업들, Anthropic Mythos 대체 모델 출시 | GeekNews
<ul> <li>미국 정부의 <strong>Mythos·Fable 5 접근 제한</strong>이 길어지면서, 일본 Sakana AI와 중국 360이 각각 Fugu와 Tulongfeng/Yitianzhen으로 생긴 공백을 겨냥함</li> <li>Sakana AI의 <strong>Fugu</strong>는 Fable 5·M…
-
DSpark: Speculative decoding을 활용한 LLM 추론 가속화
DSpark: Speculative decoding을 활용한 LLM 추론 가속화 [pdf] | GeekNews
<ul> <li>DSpark: 준자기회귀(semi-autoregressive) 생성과 신뢰도 스케줄링을 결합한 추측 디코딩(speculative decoding) 프레임워크</li> <li><strong>병렬 드래프터(parallel drafter)</strong> 가 한 번의 순전파로 긴 토큰 블록을 제안하지만 토큰 간…
-
Paca - 인간과 AI 에이전트 협업을 위한 오픈소스 프로젝트 관리 도구
Paca - 인간과 AI 에이전트 협업을 위한 오픈소스 프로젝트 관리 도구 | GeekNews
<ul> <li><strong>AI 네이티브 셀프 호스팅</strong> 프로젝트 관리 플랫폼으로, Jira/Trello/ClickUp/Monday의 무료 오픈소스 대체제</li> <li>AI 에이전트가 챗봇 애드온이 아니라 <strong>Scrum 팀의 동등한 팀원</strong>으로 참여 <ul> <li><strong…
-
NLnet Labs의 LLM 사용 정책
NLnet Labs의 LLM 사용 정책 | GeekNews
<ul> <li>NLnet Labs는 프로젝트 기여와 커뮤니케이션에서 <strong>LLM 사용을 제한</strong>하며, 정책 위반 제출물은 사전 통지 없이 닫히거나 삭제될 수 있음</li> <li>코드와 문서 기여는 <strong>사람이 직접 작성</strong>해야 하며, LLM이나 다른 확률적 도구가 생성한 내용…
-
오픈 웨이트 LLM과 폐쇄형 LLM의 격차
오픈 웨이트 LLM과 폐쇄형 LLM의 격차 | GeekNews
<ul> <li>Artificial Analysis Intelligence Index에서는 <strong>오픈 웨이트 LLM</strong>이 폐쇄형 LLM의 과거 성능을 따라잡는 시간이 2024년 여름부터 꾸준히 줄어드는 흐름을 보임</li> <li>이 단일 지표에 추세선을 그으면 격차가 <strong>2026년 12월…
-
2천 명이 내 AI 어시스턴트를 해킹하려 한 뒤 벌어진 일
2천 명이 내 AI 어시스턴트를 해킹하려 한 뒤 벌어진 일 | GeekNews
<ul> <li>hackmyclaw.com은 이메일로 AI 어시스턴트 <strong>Fiu</strong>를 속여 <code>secrets.env</code>를 유출시키는 공개 실험이었고, Hacker News 1위 이후 2,000명 이상이 6,000건 넘게 시도했지만 비밀은 새지 않음</li> <li>방어는 VPS에서 …
-
미국, Anthropic의 Mythos AI를 '신뢰된' 미국 조직에 공개 허용
미국, Anthropic의 Mythos AI를 ‘신뢰된’ 미국 조직에 공개 허용 | GeekNews
<ul> <li>미국 정부가 Anthropic의 강력한 <strong>Claude Mythos 5</strong> 차단을 풀면서, 100곳이 넘는 미국 기관·대기업·정부기관이 접근할 수 있게 됨</li> <li>2주 전 <strong>Mythos 수출통제</strong>와 Mythos·Fable 5 중단으로 커졌던 Tru…
-
오픈소스 보안을 함께 지키기 위한 Akrites 공개서한
오픈소스 보안을 함께 지키기 위한 Akrites 공개서한 | GeekNews
<ul> <li><strong>AI 기반 취약점 발견</strong>이 유지관리자의 대응 속도를 앞지르면서, Akrites는 핵심 오픈소스 소프트웨어를 공동으로 보강하기 위한 산업계 협력으로 출범함</li> <li>심각한 취약점 발견은 과거 전문가에게 몇 주 걸리던 작업이었지만, 이제는 <strong>AI 모델</stro…
-
미국 정부가 GPT-5.6 사용자를 결정할 예정
미국 정부가 GPT-5.6 사용자를 결정할 예정 | GeekNews
<ul> <li>트럼프 행정부가 최신 AI 기술에 접근하려는 기업을 <strong>정부가 직접 심사</strong>하는 정책을 확대하며, OpenAI와 Anthropic 양사 모두에 규제를 적용 중</li> <li>OpenAI는 최신 모델 <strong>Sol</strong> 출시와 함께 미국 정부 승인을 받은 기업만 접…
-
GPT‑5.6 Sol 프리뷰: 차세대 모델
GPT‑5.6 Sol 프리뷰: 차세대 모델 | GeekNews
<ul> <li>OpenAI가 <strong>GPT‑5.6 시리즈</strong>를 제한 프리뷰로 열며, 플래그십 Sol과 일상 업무용 Terra, 저비용 Luna를 함께 내놓음</li> <li>Sol은 코딩·생물학·사이버보안에서 <strong>에이전트 능력</strong>을 강화했고, <code>max</code> re…
-
Apple, 고급형 M6 Mac 칩 건너뛰고 AI 중심 M7 라인으로 전환 예정
Apple, 고급형 M6 Mac 칩 건너뛰고 AI 중심 M7 라인으로 전환 예정 | GeekNews
<ul> <li>Apple이 M1부터 M5까지 유지해온 칩 세대별 Pro/Max 변형 출시 관행을 처음으로 깨고, <strong>M6는 베이스 칩만</strong> 출시한 뒤 하이엔드 라인은 차세대 M7으로 건너뛰는 전략 변경 추진 중</li> <li>M6 베이스 칩은 올해 중 엔트리급 MacBook Pro에 탑재 예정이…
-
Show HN: OpenKnowledge – Obsidian/Notion의 오픈소스 AI
Show HN: OpenKnowledge – Obsidian/Notion의 오픈소스 AI | GeekNews
<ul> <li>개인 노트, 지식 베이스, 스펙, LLM 위키를 위한 로컬 우선 <strong>WYSIWYG Markdown 편집기</strong>이며 Claude, Codex 등 하네스와의 통합을 제공함</li> <li>Markdown 파일 편집을 Google Doc이나 Notion 페이지 편집처럼 느끼게 하는 <str…
-
Vibecoding 공개로 Emacs 패치가 거절됨
Vibecoding 공개로 Emacs 패치가 거절됨 | GeekNews
<ul> <li>macOS용 <strong>Emacs 성능 개선</strong>을 위해 만든 작은 패치가 <code>emacs-devel</code>에 제출됐지만, LLM 보조 작업을 받지 않는 GNU 정책 때문에 받아들여지지 않음</li> <li>작업자는 GLM 5.2가 이슈를 찾고 초안을 만들었다고 공개하면서도, 본인…
-
AI에게 주도권을 빼앗기지 마세요 — 두 번의 자동화 실패에서 배운 것
AI에게 주도권을 빼앗기지 마세요 — 두 번의 자동화 실패에서 배운 것 | GeekNews
<p>Claude Code로 자동매매 시스템과 블로그 자동발행을 직접 운영하다 겪은 두 번의 실패에서 출발한 글입니다.</p> <ul> <li>자동매매: 매매 도메인 지식이 부족해 AI가 짠 코드를 검증하지 못했고, 결과는 0승 8패·자산 3% 손실</li> <li>블로그 자동발행: 검수 없이 내보낸 부정확한 글로 독자 …
-
Show GN: SongRyeon Core - LLM이 쓴 말과 코드가 검증한 정보를 분리하는 로컬 에이전트 런타임 실험
<p>안녕하세요. 코딩을 배우면서 AI 에이전트 런타임을 직접 실험하고 있는 정후입니다.</p> <p>SongRyeon Core는 “LLM이 말한 판단”과 “코드가 실제로 확인한 사실”을 분리해서 다루는 작은 로컬 우선(agent runtime) 실험입니다.</p> <p>요즘 LLM 기반 에이전트를 만들다 보면 다음 문제…
-
당근전톡 — 당근마켓 가기 전에 카톡으로 동네 공개매물 먼저 둘러보기
당근전톡 — 당근마켓 가기 전에 카톡으로 동네 공개매물 먼저 둘러보기 | GeekNews
<p>안녕하세요.<br /> 카카오 PlayMCP 기반으로 당근전톡이라는 작은 MCP 서비스를 만들어봤습니다.</p> <p>당근전톡은 당근마켓 앱을 열기 전에, 카톡에서 자연어로 동네 공개매물을 먼저 찾아볼 수 있는 읽기 전용 리서치 도구입니다.</p> <p>예를 들면 이렇게 물어볼 수 있습니다.</p> <ul> <li>…
-
Ford, AI 품질검사 차질로 'gray beard' 검사관 재고용
Ford, AI 품질검사 차질로 ‘gray beard’ 검사관 재고용 | GeekNews
<ul> <li>Ford Motor Co.는 고질적인 <strong>품질 문제</strong>를 줄이기 위해 “gray beard”로 불리는 베테랑 엔지니어들을 다시 불러 젊은 직원 교육과 AI 도구 보완에 투입함</li> <li>지난 <strong>3년간 350명</strong>의 베테랑 엔지니어를 채용했으며, 다수는 …
-
도구와 대화하는 것의 피로감
도구와 대화하는 것의 피로감 | GeekNews
<ul> <li>LLM은 키보드나 자동차처럼 몸에 익는 <strong>좋은 도구</strong>가 아니라, 요청과 협상을 요구하는 상대처럼 작동해 사용자의 사회적 에너지를 소모함</li> <li>좋은 도구는 일관성과 속도 덕분에 뇌가 <strong>신체의 확장</strong>처럼 받아들이지만, Claude나 Cursor …
-
Krea 2: 오픈 가중치 12B 이미지 모델 기술 보고서
Krea 2: 오픈 가중치 12B 이미지 모델 기술 보고서 | GeekNews
<ul> <li>Krea 2는 하나의 polished default보다 <strong>창작 탐색</strong>을 중시하는 이미지 생성 파운데이션 모델로, 모델 가중치와 추론을 permissive license로 공개함</li> <li>학습 과정은 <strong>pretraining → midtraining → SFT →…
-
45°C 냉각 설계로 데이터센터 물 사용량을 거의 0으로 줄임
45°C 냉각 설계로 데이터센터 물 사용량을 거의 0으로 줄임 | GeekNews
<ul> <li>AI 서버의 전력 밀도가 커지면서 냉각이 데이터센터 비용과 물 사용의 핵심 병목이 됐고, NVIDIA는 Rubin 세대에서 냉각액을 최대 <strong>45°C</strong>로 운용하는 설계를 내세움</li> <li>Rubin 세대 AI 인프라는 칩과 네트워킹 구성요소까지 팬 없이 식히는 <strong>…
-
Reid Hoffman "SpaceX는 AI 회사가 아니고, xAI는 완전한 난장판"
Reid Hoffman “SpaceX는 AI 회사가 아니고, xAI는 완전한 난장판” | GeekNews
<ul> <li>Reid Hoffman은 SpaceX의 AI 행보를 <strong>시장가치로 AI 회사를 사들여 관련성을 확보하려는 전략</strong>으로 해석했고, xAI는 기반 모델 구축에서 “완전한 난장판”이며 세 번째 재시작 상태라고 봄</li> <li>xAI는 2026년 5월까지 <strong>원래 공동창업자 …
-
Anthropic, "Alibaba가 Claude AI 모델 역량을 불법 추출했다"
Anthropic, “Alibaba가 Claude AI 모델 역량을 불법 추출했다” | GeekNews
<ul> <li>미 상원 AI 청문회를 앞두고 Anthropic은 Alibaba 관련 활동이 자사를 겨냥한 동종 공격 중 <strong>최대 규모</strong>였다고 주장함</li> <li>핵심 방식은 더 강한 모델의 출력으로 약한 모델을 학습시키는 <strong>증류(distillation)</strong> 로, An…
-
Code as Agent Harness — 코드를 에이전트의 실행 기반으로 보는 102페이
Code as Agent Harness — 코드를 에이전트의 실행 기반으로 보는 102페이 | GeekNews
<p><strong>UIUC × Meta × Stanford</strong> 합작. 5월 arXiv에 올라온 서베이 논문인데, 관점이 꽤 재밌다.</p> <h3>핵심 주장</h3> <p><strong>"코드는 더 이상 LLM이 생성하는 결과물이 아니다. 에이전트가 추론하고, 행동하고, 상태를 저장하고, 피드백을 …
-
AI시대, 나의 전문성을 재설계하는 법 [구글 슬라이드, 165P]
AI시대, 나의 전문성을 재설계하는 법 [구글 슬라이드, 165P] | GeekNews
<ul> <li>데이터오븐 하용호님의 발표자료</li> <li>회사의 <strong>AX(AI 전환)</strong> 여정은 대부분 비슷한 5단계를 거침 — <strong>환호 → 정체 → 신남 → 의구심 → 마지막 고비</strong></li> <li><strong>AI J curve Trap</strong> - AI …
-
Cafe24, LLM Router 공개
Cafe24, LLM Router 공개 | GeekNews
<ul> <li>Claude, Gemini, Qwen, Llama, DeepSeek 등 <strong>100개 이상 모델</strong>을 <strong>단일 엔드포인트</strong>로 호출하는 통합 LLM 인프라</li> <li><strong>OpenAI 호환 단일 API</strong>를 제공해, Provider마다…