-
Claude Fable 5 재배포
Redeploying Claude Fable 5
-
Genebench-Pro 내부
Inside Genebench-Pro
-
Core dump 역학: 18년 된 버그 수정
Core dump epidemiology: fixing an 18-year-old bug
OpenAI engineers used large-scale core dump analysis to debug rare infrastructure crashes, uncovering both a hardware fault and a long-standing software bug.
-
GeneBench-Pro 소개
Introducing GeneBench-Pro
Introducing GeneBench-Pro, a new benchmark testing AI performance in genomics, biology, and scientific research using complex, real-world datasets.
-
Claude Science - 과학자를 위한 AI 워크벤치
Claude Science, an AI workbench for scientists
-
Claude Sonnet 5 소개
Introducing Claude Sonnet 5
-
Qwen 3.6 27B는 로컬 개발의 최적 지점
Qwen 3.6 27B는 로컬 개발의 최적 지점 | GeekNews
<ul> <li><strong>Qwen 3.6 27B</strong>는 로컬 모델에 회의적이던 사용자에게도 범용 작업에서 의미 있는 선택지로 보이며, 35B A3B보다 느리지만 더 강력한 dense 모델로 추천됨</li> <li>창작·코딩 테스트에서는 <strong>제약 조건 준수</strong>가 강점으로 드러났고, O…
-
한국, 메모리 칩 생산과 휴머노이드 로봇에 1조 달러 투자
South Korea to spend $1T on more memory chip production and humanoid robots
<p>Article URL: <a href="https://arstechnica.com/ai/2026/06/south-korea-to-spend-1t-on-more-memory-chip-production-and-humanoid-robots/">https://arstechnica.com/ai/2026/06/south-ko…
-
Ornith-1.0: 에이전트 코딩을 위한 자가 개선 오픈소스 모델
Ornith-1.0: self-improving open-source models for agentic coding
<p>Article URL: <a href="https://github.com/deepreinforce-ai/Ornith-1">https://github.com/deepreinforce-ai/Ornith-1</a></p> <p>Comments URL: <a href="https://news.ycombinator.com/i…
-
Qwen 3.6 27B: 로컬 개발의 최적 모델
Qwen 3.6 27B is the sweet spot for local development - Quesma Blog
<p>Article URL: <a href="https://quesma.com/blog/qwen-36-is-awesome/">https://quesma.com/blog/qwen-36-is-awesome/</a></p> <p>Comments URL: <a href="https://news.ycombinator.com/ite…
-
Tidal AI 정책
Tidal AI Policy
<p>Article URL: <a href="https://tidal.com/ai-policy">https://tidal.com/ai-policy</a></p> <p>Comments URL: <a href="https://news.ycombinator.com/item?id=48718840">https://news.ycom…
-
Import AI 463: 자체 개선 로봇, 10k 중국 GPU 클러스터, 그리고 인류 시대를 애도하는 에세이
Import AI 463: Self-improving robots; a 10k Chinese GPU cluster; and an elegiac essay for the human era
What eras bookend our interregnum?
-
당근전톡 — 당근마켓 가기 전에 카톡으로 동네 공개매물 먼저 둘러보기
당근전톡 — 당근마켓 가기 전에 카톡으로 동네 공개매물 먼저 둘러보기 | GeekNews
<p>안녕하세요.<br /> 카카오 PlayMCP 기반으로 당근전톡이라는 작은 MCP 서비스를 만들어봤습니다.</p> <p>당근전톡은 당근마켓 앱을 열기 전에, 카톡에서 자연어로 동네 공개매물을 먼저 찾아볼 수 있는 읽기 전용 리서치 도구입니다.</p> <p>예를 들면 이렇게 물어볼 수 있습니다.</p> <p>합정동에서 …
-
유럽의 AI 인력 기회
Mapping Europe’s AI Workforce Opportunity
A new OpenAI report maps how AI could reshape jobs across the EU, highlighting which occupations may face automation, growth, or workflow changes.
-
Brown 시험서 대규모 AI 부정행위 고발한 교수
Brown 시험서 대규모 AI 부정행위 고발한 교수 | GeekNews
<ul> <li>Brown University의 고급 수리경제학 과목 <strong>ECON 1170</strong>에서 3월 중간고사 중 최소 50명이 AI로 부정행위를 했다는 의혹이 제기되며 학업 신뢰 문제가 커짐</li> <li>시험은 <strong>take-home 폐쇄형</strong> 방식이었고, 일부 답안에서…
-
Show GN: AI 코딩 에이전트 여러 개를 한 창에서 조율하는 올인원 데스크톱 터미널 — Orch term
<p>터미널·코드 에디터·브라우저·Git을 한 창에 담고, 그 위에서 여러 AI 코딩 에이전트(Claude Code, Codex, Gemini CLI 등)를 동시에 돌려 조율하는 데스크톱 앱입니다. Windows와 macOS를 지원합니다.</p> <p>왜 만들었나</p> <p>AI 에이전트로 개발하다 보니, 터미널 하나에…
-
Tokenmaxxing은 죽었다, Tokenmaxxing 만세
Tokenmaxxing은 죽었다, Tokenmaxxing 만세 | GeekNews
<ul> <li>기업의 AI 도입 초기에 <strong>토큰 사용량</strong>을 성과 평가와 연결한 tokenmaxxing은 무의미한 비용을 만들었지만, AI 도구 사용을 조직에 강제로 퍼뜨리는 역할도 했음</li> <li>Meta에서는 개인별 토큰 사용량이 평가와 연결되자, 토큰 수치를 올리기 위해 두 에이전트를 …
-
Claude Code로 내 MRI 2차 소견을 받아봤음
Claude Code로 내 MRI 2차 소견을 받아봄 | GeekNews
<ul> <li>오른쪽 어깨 통증 MRI 이후 병원의 <strong>Grade III 부분층 파열</strong> 진단과 빠른 치료 계획에 의문이 생겨, Opus 4.8로 영상 판독을 다시 시도함</li> <li>병원은 견갑하근 힘줄의 “apical insertion” 부위에서 <strong>50% 초과 폭의 부분층 파열…
-
GTM을 위한 AI가 성과를 내지 못한 이유 (그리고 해결 방법)
GTM을 위한 AI가 성과를 내지 못한 이유 (그리고 해결 방법) | GeekNews
<ul> <li>이메일 작성, AI SDR, 인텐트 도구 등 다양한 AI를 도입한 <strong>GTM 팀</strong> 대부분이 기대만큼 영업 생산성·파이프라인·매출 향상을 체감하지 못하고 있음</li> <li>AI에 계정 공략을 맡기면 "Acme가 SDR을 채용 중이고 작년 실주 건이 있으니 연락하라&quo…
-
결정과 돈: 회사가 '앤트로픽이 이걸 만든다면?' 질문에서 살아남는 법
결정과 돈: 회사가 "앤트로픽이 이걸 만든다면?" 질문에서 살아남는 법 | GeekNews
<ul> <li>AI 모델이 강력해질수록 소프트웨어 자체의 가치는 떨어지며, 살아남으려는 애플리케이션 회사는 <strong>데이터 회사이자 핀테크 회사</strong>로 동시에 전환 필요</li> <li>에이전트가 소프트웨어의 주된 사용자가 되면서 per-seat 가격 모델이 붕괴, 천 명이 십만 개 에이전트를 돌려도 십…
-
GLM 5.2, Semgrep IDOR 벤치마크에서 Claude 앞서
GLM 5.2, Semgrep IDOR 벤치마크에서 Claude 앞서 | GeekNews
<ul> <li>Semgrep의 <strong>IDOR 취약점 탐지</strong> 벤치마크에서 Zhipu AI의 open-weight 모델 <strong>GLM 5.2</strong>가 단순 프롬프트 조건만으로 Claude Code보다 높은 F1을 기록함</li> <li>실험은 데이터셋·평가 방식·시스템 프롬프트를 고정…
-
Show GN: 아이디어부터 앱스토어까지 — Flutter/Flame 게임 출시 하네스 (Claude Code 플러그인)
<p>Flutter/Flame 게임을 "아이디어 → 기획 → 개발 → QA → 스토어 제출"까지 끌고 가는 Claude Code 플러그인을 오픈소스로 공개합니다.</p> <p>Flame 게임을 직접 여러 개 만들어 스토어에 올리면서, 매번 반복하던 절차와 매번 다시 밟던 함정을 하네스로 코드화했습니다. …
-
AI 슬롭과 온라인 소음에 대한 최고의 답은 Robin Williams에게서 나온다
AI 슬롭과 온라인 소음에 대한 최고의 답은 Robin Williams에게서 나온다 | GeekNews
<ul> <li><em>Good Will Hunting</em>의 벤치 장면은 <strong>책으로 아는 지식</strong>과 직접 살아낸 경험의 차이를 통해 AI 슬롭·무한 조언·온라인 소음이 놓치는 것을 보여줌</li> <li>AI는 인터넷을 읽었지만 <strong>상황을 읽거나 삶을 살아본 적이 없고</strong…
-
아시아 AI 스타트업들, Anthropic Mythos 대체 모델 출시
아시아 AI 스타트업들, Anthropic Mythos 대체 모델 출시 | GeekNews
<ul> <li>미국 정부의 <strong>Mythos·Fable 5 접근 제한</strong>이 길어지면서, 일본 Sakana AI와 중국 360이 각각 Fugu와 Tulongfeng/Yitianzhen으로 생긴 공백을 겨냥함</li> <li>Sakana AI의 <strong>Fugu</strong>는 Fable 5·M…
-
우리도 Mythos를 가지고 있다: GLM 5.2가 사이버 벤치마크에서 Claude를 이기다
We have Mythos at Home: GLM 5.2 beats Claude in our Cyber Benchmarks
<p>Article URL: <a href="https://semgrep.dev/blog/2026/we-have-mythos-at-home-glm-52-beats-claude-in-our-cyber-benchmarks/">https://semgrep.dev/blog/2026/we-have-mythos-at-home-glm…
-
HP Inc., OpenAI와 Frontier 전략 파트너십 출범
HP Inc. launches Frontier strategic partnership with OpenAI
HP Inc. scales its OpenAI Frontier partnership to deploy AI across customer experiences, software development, and enterprise operations.
-
브라운 대학교 AI 부정행위 교수 규탄: '학업 신뢰 위험'
Professor denounces mass AI fraud on an exam at Brown University: ‘Academic integrity is at risk’
<p>Article URL: <a href="https://english.elpais.com/education/2026-06-28/ai-fraud-at-brown-university-academic-integrity-is-at-risk.html">https://english.elpais.com/education/2026-…
-
Opus 4.8으로 MRI 제2의견을 받고 그것이 나에게 남긴 것
Using Opus 4.8 to get a second opinion on an MRI and where it leaves me
<p>Article URL: <a href="https://antoine.fi/mri-analysis-using-claude-code-opus">https://antoine.fi/mri-analysis-using-claude-code-opus</a></p> <p>Comments URL: <a href="https://ne…
-
OpenAI Codex의 민감한 파일 제외 문제, 아직 미해결
A way to exclude sensitive files issue still open for OpenAI Codex
<p>Article URL: <a href="https://github.com/openai/codex/issues/2847">https://github.com/openai/codex/issues/2847</a></p> <p>Comments URL: <a href="https://news.ycombinator.com/ite…
-
AI 쓰레기, 무한한 조언, 온라인 노이즈에 대한 최고의 대응은 로빈 윌리엄스다
The best response to AI slop, infinite advice, and online noise is from Robin Williams
<p>Article URL: <a href="https://jayacunzo.com/blog/your-move-chief">https://jayacunzo.com/blog/your-move-chief</a></p> <p>Comments URL: <a href="https://news.ycombinator.com/item?…