-
Claude Code 팀의 Cat과 Thariq과의 옆자리 대담
A Fireside Chat with Cat and Thariq from the Claude Code team
<p>Earlier this month I hosted a fireside chat session at the <a href="https://www.ai.engineer/worldsfair/2026">AI Engineer World's Fair</a> with Cat Wu and Thariq Shihipar from An…
-
인간 수학자, 반례 찾기에서 AI에 추월당하다
인간 수학자, 반례 찾기에서 AI에 추월당하다 | GeekNews
<ul> <li>ChatGPT와 Claude 계열 모델이 불과 몇 주 사이 Erdős의 단위 거리 추측, Grothendieck의 군 스킴 질문, <strong>Jacobian Conjecture</strong>에 반례를 만들었으며 일부는 Lean으로 검증됨</li> <li>OpenAI의 <strong>Sol</stron…
-
Qwen-Image-3.0: 풍부한 콘텐츠, 진정한 세부사항, 깊은 지식
Qwen-Image-3.0: Rich Content, Authentic Details, Deep Knowledge
<p>Article URL: <a href="https://qwen.ai/blog?id=qwen-image-3.0">https://qwen.ai/blog?id=qwen-image-3.0</a></p> <p>Comments URL: <a href="https://news.ycombinator.com/item?id=48989…
-
미국 5대 기술 기업의 숨겨진 부채, 불투명한 AI 자금 조달로 1.65조 달러 급증
Five US tech giants' hidden debts soar to $1.65tn on opaque AI funding
<p>Article URL: <a href="https://asia.nikkei.com/business/technology/five-us-tech-giants-hidden-debts-soar-to-1.65tn-on-opaque-ai-funding">https://asia.nikkei.com/business/technolo…
-
Kimi K3·Qwen 3.8과 Anthropic의 잠재적 균열
Kimi K3·Qwen 3.8과 Anthropic의 잠재적 균열 | GeekNews
<ul> <li>Moonshot Labs의 <strong>Kimi K3</strong>와 Alibaba의 <strong>Qwen 3.8</strong>이 Anthropic Fable 5에 근접한 성능을 내는 것으로 알려졌고, 수주 안에 가중치까지 공개될 예정이어서 최첨단 모델 경쟁이 개방형 모델로 확장됨</li> <li>…
-
arXiv 논문 12,750편에서 AI 문체를 측정한 방법과 한계
arXiv 논문 12,750편에서 AI 문체를 측정한 방법과 한계 | GeekNews
<ul> <li>arXiv 논문 <strong>12,750편의 본문 전체</strong>를 분석한 결과, 최신 논문의 약 3분의 1이 기계 작성처럼 읽혔으며 최근 완결 분기 판정률은 약 32%였음</li> <li>2021~2022년 논문을 인간 작성 대조군으로 삼아 <strong>오탐률 0.4%</strong> 에 맞춰 …
-
Kimi Work: 지식 노동자를 위한 차세대 데스크톱 AI 에이전트
Kimi Work: 지식 노동자를 위한 차세대 데스크톱 AI 에이전트 | GeekNews
<ul> <li><strong>Kimi Work</strong>는 로컬 파일 연결, 브라우저 자동화, 백그라운드 코드 실행, 예약 작업을 결합해 깊이 있는 업무를 수행하는 데스크톱 AI 에이전트임</li> <li>내장 <strong>Cron 엔진</strong>으로 LLM 에이전트 호출과 Python·Shell 실행을 매…
-
누가 중국 모델을 두려워하는가?
누가 중국 모델을 두려워하는가? | GeekNews
<ul> <li>중국 오픈 웨이트 모델 <strong>Kimi K3</strong>가 최첨단 모델에 근접했지만, AI 사업의 경쟁력은 모델 개발비보다 정답 수준의 지능을 제공하는 <strong>매출원가(COGS)</strong> 에서 갈림</li> <li>모델마다 정답에 도달하는 데 필요한 토큰 양이 달라 토큰 자체는 대…
-
OpenCode의 성가시고 불안한 문제들
OpenCode의 성가시고 불안한 문제들 | GeekNews
<ul> <li>GitHub 스타 16.1만 개를 받은 오픈소스 AI 코딩 에이전트 <strong>OpenCode</strong>를 로컬 Qwen3.6-27B로 시험한 결과, 도구 품질과 보안 설계 모두 사용을 중단해야 할 수준이었음</li> <li>AGENTS.md 재로딩, 고정 거리 컨텍스트 가지치기, 현재 날짜 삽입…
-
WordPress RCE를 GPT5.6과 25달러로 발견
WordPress RCE를 GPT5.6과 25달러로 발견 | GeekNews
<ul> <li>GPT5.6 Sol Ultra가 최신 안정판 WordPress를 분석해 <strong>인증 전 SQL 주입</strong>부터 관리자 계정 생성과 원격 코드 실행(RCE)까지 이어지는 공격 체인을 10여 시간 만에 완성함</li> <li>출발점은 WordPress 5.6부터 제공된 <strong>Batch…
-
Claude Fable이 Jacobian 추측의 반례를 만들다
Claude Fable이 Jacobian 추측의 반례를 만들다 | GeekNews
<ul> <li><strong>Claude Fable</strong>이 만든 것으로 소개된 다항식 사상은 Jacobian 행렬식이 상수 <code>-2</code>이면서 서로 다른 세 점을 같은 점으로 보내 <strong>Jacobian 추측의 반례</strong>가 됨</li> <li>이 사상은 <code>ℂ³ → ℂ³…
-
중국의 오픈 가중치 AI 전략이 앞서고 있음
중국의 오픈 가중치 AI 전략이 앞서고 있음 | GeekNews
<ul> <li>AI 모델은 브랜드 충성도와 피상적인 전환 비용 외에는 방어력이 크지 않아, 중국의 <strong>오픈 가중치 전략</strong>이 미국의 폐쇄형 모델보다 넓은 배포 생태계를 형성하고 있음</li> <li>기업 AI의 실질적인 방어력은 모델보다 계약, 사내 시스템 연동, 편의 기능 같은 <strong>주…
-
Moonshot AI, Kimi K3 수요 급증으로 신규 구독 일시 중단
Moonshot AI, Kimi K3 수요 급증으로 신규 구독 일시 중단 | GeekNews
<ul> <li><strong>Kimi K3 수요</strong>가 예상보다 크게 늘어 최근 48시간 동안 GPU 사용량이 현재 용량 한계에 근접함</li> <li>기존 구독자의 이용 경험을 보호하기 위해 <strong>신규 구독을 일시 중단</strong>하고 현재 회원에게 컴퓨팅 자원을 우선 배정함</li> <li>기…
-
Kimi Work: 지식 노동자를 위한 차세대 데스크톱 AI 에이전트
Kimi Work: Next-Gen Desktop AI Agent for Knowledge Workers
<p>Article URL: <a href="https://www.kimi.com/products/kimi-work">https://www.kimi.com/products/kimi-work</a></p> <p>Comments URL: <a href="https://news.ycombinator.com/item?id=489…
-
arXiv에서 AI 글쓰기를 측정한 방법과 그 한계
How we measured AI writing across arXiv, and where the measurement breaks
<p>Article URL: <a href="https://unslop.run/blog/measuring-ai-writing-on-arxiv">https://unslop.run/blog/measuring-ai-writing-on-arxiv</a></p> <p>Comments URL: <a href="https://news…
-
newsline – Claude Code 기다리는 동안 상태줄에서 읽는 한 줄 뉴스
newsline – Claude Code 기다리는 동안 상태줄에서 읽는 한 줄 뉴스 | GeekNews
<p>Claude Code에 긴 작업을 시키면 <code>esc to interrupt</code>를 멍하니 보는 시간이 쌓입니다.<br /> 딴 일 하기엔 짧고 가만히 있기엔 긴 그 시간에, 세션 하단 상태줄에서 뉴스 헤드라인을<br /> 한 줄씩 읽으면 어떨까 싶어서 만들었습니다.</p> <h4>무엇을 하나</h4> …
-
Kimi K3, Qwen 3.8, 그리고 Anthropic의 (잠재적) 붕괴
Kimi K3, Qwen 3.8, and Anthropic's (Potential) Unravelling
<p>Article URL: <a href="https://www.emergingtrajectories.com/lh/frontier-lab-economics/">https://www.emergingtrajectories.com/lh/frontier-lab-economics/</a></p> <p>Comments URL: <…
-
미국 AI는 폐쇄적이고 독점적이다. 경쟁에서 뒤처지고 있다
American AI is locked down and proprietary. It's losing.
<p>Article URL: <a href="https://werd.io/american-ai-is-locked-down-and-proprietary-its-losing/">https://werd.io/american-ai-is-locked-down-and-proprietary-its-losing/</a></p> <p>C…
-
Codex CLI의 Subagent 세션 로그가 수백 GB까지 증가해 디스크를 소진하는 문
Codex CLI의 Subagent 세션 로그가 수백 GB까지 증가해 디스크를 소진하는 문 | GeekNews
<ul> <li>Codex CLI가 Resume된 장기 세션에서 Subagent를 반복 생성할 때, <code>~/.codex/sessions</code> 아래의 JSONL 세션 파일이 비정상적으로 증가하는 문제가 보고됨</li> <li>공개 사례에서는 하나의 Resume된 부모 세션에서 2,393개의 Subagent 세…
-
익스플로잇 브로커가 WordPress RCE에 50만 달러를 지불할 때, 나는 GPT5.6 Sol Ultra로 25달러에 찾았다
Exploit brokers pay $500,000 for a WordPress RCE. I found one with GPT5.6 Sol Ultra and $25 › Searchlight Cyber
<p>Article URL: <a href="https://slcyber.io/research-center/exploit-brokers-pay-500000-for-a-wordpress-rce-i-found-one-with-gpt5-6/">https://slcyber.io/research-center/exploit-brok…
-
sessionhub - 흩어진 Claude Code, Codex 세션을 한 곳에서 검색
sessionhub - 흩어진 Claude Code, Codex 세션을 한 곳에서 검색 | GeekNews
<p>sessionhub는 여러 머신에 흩어진 Claude Code · Codex 세션을 한 곳에 모아 검색하는 도구입니다.</p> <p>데스크톱과 노트북을 오가고 가끔 서버에서도 개발하는데, "이거 전에 해봤는데" 싶은 작업이 어느 머신에 있었는지 자주 헷갈렸습니다. Claude Code랑 Codex …
-
AI 조언을 받으면 정확도는 3분의 1로 떨어지고 자신감은 2배 이상 높아짐
AI 조언을 받으면 정확도는 3분의 1로 떨어지고 자신감은 2배 이상 높아짐 | GeekNews
<ul> <li>AI 조언을 이용한 참가자는 “모른다”고 답하는 비율이 44%에서 3%로 급감했고, <strong>정확도는 27%에서 9%로 하락</strong>한 반면 자신감은 30%에서 76%로 상승함</li> <li>연구진은 합리적인 도구 위임과 구분하기 위해 영화 속 시각적 세부 정보처럼 <strong>AI가 자주…
-
OpenAI, Codex 모델 컨텍스트 크기를 372k에서 272k로 축소
OpenAI, Codex 모델 컨텍스트 크기를 372k에서 272k로 축소 | GeekNews
<ul> <li>OpenAI Codex의 <strong>번들 모델 메타데이터</strong>를 갱신하면서 모델 컨텍스트 크기를 372k에서 272k로 줄인 변경을 <code>release/0.144</code> 브랜치에 백포트함</li> <li>PR #33972는 <code>agent/hotfix-0.144-model-m…
-
클로드 페이블이 야코비안 추측의 반례를 증명했다
Claude Fable produced a counterexample to the Jacobian Conjecture
<p>Article URL: <a href="https://xcancel.com/__alpoge__/status/2079028340955197566">https://xcancel.com/__alpoge__/status/2079028340955197566</a></p> <p>Comments URL: <a href="http…
-
태스크 이코노미 - 데이터가 만드는 다음 1조 달러 시장
태스크 이코노미 - 데이터가 만드는 다음 1조 달러 시장 | GeekNews
<ul> <li>AI 사용량을 나타내는 <strong>토큰</strong>처럼, 모델 능력을 개선하는 데이터 작업 단위인 <strong>태스크(task)</strong> 가 AI 투자를 측정하는 대규모 시장을 형성할 전망임</li> <li>인터넷 학습 데이터와 단순·범용 능력이 포화되면서, 실제 환경에서 전문가의 암묵지를…
-
데이터가 유일한 해자다
데이터가 유일한 해자다 | GeekNews
<ul> <li>AI 애플리케이션 시장은 <strong>문제 복잡성</strong>과 도입 난이도에 따라 나뉘지만, 지속적인 경쟁 우위는 결국 사용 과정에서 축적되는 데이터에 달려 있음</li> <li>도입이 쉬운 제품은 대규모 사용과 빠른 피드백으로 <strong>데이터 플라이휠</strong>을 만들 수 있지만, 교체…
-
Supabase가 조사한 2026년 스타트업 현황
Supabase가 조사한 2026년 스타트업 현황 | GeekNews
<ul> <li>스타트업 빌더 2,000명을 조사한 결과, 2025~2026년 사이 창업자는 더 고령·비기술·1인 중심으로 바뀌었고 <strong>AI 작성 코드</strong>가 일반화됐으며 창업 지역도 넓어짐</li> <li><strong>Anthropic</strong>이 개발 도구·유료 구독·모델 공급자·에이전트 …
-
Claude Code, Rust로 재작성된 Bun 사용
Claude Code, Rust로 재작성된 Bun 사용 | GeekNews
<ul> <li>Claude Code <strong>v2.1.181</strong>부터 Rust로 포팅된 Bun을 내장해 Linux 시작 속도가 10% 빨라졌지만, 대부분의 사용자는 변화를 거의 알아차리지 못함</li> <li>실행 파일의 문자열을 조사하면 정식 태그가 아직 없는 <strong>Bun v1.4.0</str…
-
AI 광풍이 전 세계의 의사결정을 무너뜨리고 있음
AI 광풍이 전 세계의 의사결정을 무너뜨리고 있음 | GeekNews
<ul> <li>지난 18개월간 관찰하거나 참여를 요청받은 AI 프로젝트의 성공률은 <strong>0%</strong> 였으며, 기술의 불확실성과 기존 소프트웨어 프로젝트의 부실한 운영이 겹쳐 투자가 성과로 이어지지 않았음</li> <li>직원 500명 이상인 조직에서는 AI의 효용을 의심하는 것만으로 승진과 고용이 위태…
-
MIDI 레코더 2,500대를 판매하며 배운 것: 하드웨어는 그렇게 어렵지 않다
MIDI 레코더 2,500대를 판매하며 배운 것: 하드웨어는 그렇게 어렵지 않다 | GeekNews
<ul> <li>피아노 연주를 자동으로 기록하는 <strong>Jamcorder</strong>는 출시 1년 반 만에 2,500대 이상 판매돼 독립적으로 유지 가능한 사업이 됨</li> <li>개발에서 가장 어려웠던 부분은 하드웨어가 아니라 펌웨어·앱·제조 도구에 걸친 약 <strong>20만 줄의 소프트웨어</stron…