-
2026년 4월 30일 사회적 영향: 사람들이 Claude에 개인 지도를 요청하는 방식
How people ask Claude for personal guidance
-
지름길에서 사보타주까지: 보상 해킹으로 인한 창발적 오정렬
From shortcuts to sabotage: natural emergent misalignment from reward hacking
-
차세대 헌법 기반 분류기: 보편적 탈옥에 대한 더 효율적인 보호
Next-generation Constitutional Classifiers: More efficient protection against universal jailbreaks
-
자동화된 정렬 연구자들: 대규모 언어 모델을 활용한 확장 가능한 감시
Automated Alignment Researchers: Using large language models to scale scalable oversight
-
페르소나 선택 모델
The persona selection model
-
2026년 5월 25일 공지사항: Anthropic 공동창업자 크리스 올라의 교황 레오 14세 회칙 '매그니피카 후마니타스'에 대한 발언
May 25, 2026 Announcements Anthropic co-founder Chris Olah's remarks on Pope Leo XIV's encyclical "Magnifica humanitas"
-
2026년 5월 19일 공지: 프론티어 AI에 대한 대화 확대
May 19, 2026 Announcements Widening the conversation on frontier AI
-
Show GN: AI News - 빅테크 공식 소식과 최신 AI 뉴스를 모아보는 크롬 확장 프로그램
<p>안녕하세요.<br /> AI 기업들의 리서치와 테크 블로그를 가끔 들어가 확인하곤 했는데, 좀 더 편하게 보기 위해 크롬 브라우저 확장 프로그램을 만들어봤습니다.<br /> 브라우저 사이드패널에 주요 AI 기업 공식 피드를 모아두고, 구글 뉴스 RSS를 통해 최신 AI 뉴스도 함께 수집하도록 했습니다.<br /> 막…
-
Claude가 rsync의 버그를 증가시켰을까?
Did Claude increase bugs in rsync?
<p>Article URL: <a href="https://alexispurslane.github.io/rsync-analysis/">https://alexispurslane.github.io/rsync-analysis/</a></p> <p>Comments URL: <a href="https://news.ycombinat…
-
Defending Code Reference Harness - AI 기반 취약점 발견과 수정용 Anthropic 오픈소스 프레임워크
<ul> <li><strong>Defending Code Reference Harness</strong>는 Claude로 자율 취약점 발견과 수정을 수행하기 위한 참조 구현이며, 여러 조직의 보안팀과 협업하며 얻은 학습을 바탕으로 구성한 프로젝트임</li> <li>이 저장소는 제품이 아니라 <strong>참조 구현</st…
-
케임브릿지 대학교의 연구진들은 네트워크 전반에 걸쳐 적응하는 AI 웜을 구축하였습니다
케임브릿지 대학교의 연구진들은 네트워크 전반에 걸쳐 적응하는 AI 웜을 구축하였습니다. | GeekNews
<blockquote> <p>토론토대 연구진 등이 고정된 취약점 목록 대신 오픈웨이트 소형 언어모델(LLM)을 활용해 스스로 타깃을 분석하고 공격 전략을 수립해 기업 네트워크를 전파하는 자율형 AI 웜(Worm)의 개념 증명에 성공했습니다.</p> </blockquote> <hr /> <h4>전문 번역</h4> <p>토론…
-
-
AI-네이티브 스타트업을 만드는 방법
AI-네이티브 스타트업을 만드는 방법 | GeekNews
<ul> <li>AI가 반복 업무를 야간에 처리하는 동안 <strong>창업자는 제품 개선에 집중</strong>하는 새로운 운영 모델로, 진짜 변화는 시간 사용이 아니라 <strong>회사가 학습·반복·진화하는 속도</strong>에 있음</li> <li><strong>AI-네이티브 회사</strong>는 운영 모델 자…
-
Meta가 단종된 Portal 기기에서 ADB 활성화 [영상]
Meta enables ADB on deprecated Portal devices [video]
<p><a href="https://developers.meta.com/horizon/blog/build-apps-for-portal-with-ai/" rel="nofollow">https://developers.meta.com/horizon/blog/build-apps-for-port...</a></p> <hr /> <…
-
AI 사용과 수학 능력 저하 속 Berkeley CS 수업에서 낙제 성적 급증
AI 사용과 수학 능력 저하 속 Berkeley CS 수업에서 낙제 성적 급증 | GeekNews
<ul> <li>Berkeley CS 수업의 <strong>낙제율</strong>은 2026년 봄 CS 10 35.3%, CS 61A 10.6%로 과거 학기보다 크게 높아졌고, 하위 과정 D·F 비율 7%와 평균 GPA 2.8~3.3이라는 EECS 지침에서 벗어남</li> <li>Dan Garcia는 Claude, Cha…
-
AI가 스스로를 만들 때: 재귀적 자기 개선을 향한 우리의 진전
AI가 스스로를 만들 때: 재귀적 자기 개선을 향한 우리의 진전 | GeekNews
<ul> <li>AI 개발에서 인간이 맡던 구현·실험 작업의 더 큰 비중이 AI 시스템으로 넘어가며 개발 속도를 높이고, 충분한 컴퓨트와 진전이 결합되면 후속 모델을 자율 설계·개발하는 <strong>재귀적 자기 개선</strong>으로 이어질 수 있음</li> <li>모델이 독립적으로 완료할 수 있는 <strong>작업…
-
Anthropic은 제품 전반에서 Claude를 어떻게 봉쇄할까
Anthropic은 제품 전반에서 Claude를 어떻게 봉쇄할까 | GeekNews
<ul> <li>에이전트의 능력과 접근권한이 커질수록 <strong>잠재적 피해 반경</strong> 도 함께 확대되며, 클로드 웹/Claude Code/Cowork 각각에 맞춘 봉쇄 아키텍처 구축 경험을 정리</li> <li>위험은 <strong>실패 가능성</strong>과 <strong>피해 규모</strong> 두…
-
Claude를 화학자로 만들기
Making Claude a chemist
-
Ask HN: GenAI로 느낀 "아, 큰일 났다" 순간은?
Ask HN: What was your "oh shit" moment with GenAI? | Hacker News
<p>Most of us were amused when DALL-E and its peers went mainstream, and we were quick to point out the obvious flaws.<p>Then ChatGPT hit the scene and again, many of us dismissed …
-
현실: 최종 평가 - Andon Labs의 Lukas Petersson과 Axel Backlund
Reality: The Final Eval — Lukas Petersson and Axel Backlund of Andon Labs
We talk with the VendingBench authors on evaling Claudes from Haiku to Mythos, and how they build leading, and lasting, frontier evals from scratch.
-
GitHub - anthropics/defending-code-reference-harness: 위협 모델링, 스캔, 분류, 패칭 및 커스터마이징 가능한 자율 스캔 도구
GitHub - anthropics/defending-code-reference-harness: Skills for threat modeling, scanning, triage, patching, plus an autonomous scanning harness you can /customize
<p>Article URL: <a href="https://github.com/anthropics/defending-code-reference-harness">https://github.com/anthropics/defending-code-reference-harness</a></p> <p>Comments URL: <a …
-
32GB DDR5가 이제 최소 $375 — AI발 공급 부족이 PC 조립을 계속 압박
32GB DDR5가 이제 최소 $375 — AI발 공급 부족이 PC 조립을 계속 압박 | GeekNews
<ul> <li><strong>DDR5 32GB</strong>는 2026년 게이밍 PC와 고성능 PC 구성의 적정 용량으로 여겨지지만, AI 수요가 PC 하드웨어 공급망의 제조 역량을 소모하면서 최저가가 $374.97까지 상승함</li> <li>RAM 가격 추적 기준으로 1년 전 $100 미만이던 키트가 이제 16GB는…
-
AI와 함께 일하는 디자이너의 하루는 어떻게 달라졌을까?
AI와 함께 일하는 디자이너의 하루는 어떻게 달라졌을까? | GeekNews
<p>Gstack·Claude·Figma AI까지, 디자이너의 새로운 업무 방식과 아직 남아있는 현실적인 과제들</p> <p>AI와 함께 일하는 디자이너의 실무 변화를 분석한 글.<br /> 도구의 속도는 빨라졌으나 실제 업무 효율성 향상은 기대 이하라는 현실을 조명하고 있음.</p> <p>문제 정의 영역에서의 AI 활용…
-
Endava가 AI 에이전트를 중심으로 소프트웨어 배포를 재설계하는 방법
How Endava is redesigning software delivery around AI agents
Learn how Endava is using AI agents, ChatGPT Enterprise, and Codex to accelerate software delivery, automate workflows, and build an AI-native culture across the enterprise.
-
꿈꾸기: 더 도움이 되는 ChatGPT를 위한 향상된 메모리
Dreaming: Better memory for a more helpful ChatGPT
ChatGPT introduces a new memory system to better remember preferences, keeping context fresh and relevant across conversations.
-
그들은 가중치로 만들어졌다
그들은 가중치로 만들어졌다 | GeekNews
<ul> <li><strong>가중치</strong>는 AI 모델 안에 사전, 문법 규칙, 작은 사람, 언어 모듈, 추론 장치, 데이터베이스가 따로 없고 80개 층의 부동소수점 숫자 곱셈이 문장과 추론을 만든다는 풍자적 전제임</li> <li>성과 평가의 어조 완화와 추도문 작성도 기술적으로 <strong>다음 토큰 예측…
-
VLM은 한국 공공기관 문서를 얼마나 잘 읽을까? KOLongDoc 벤치마크 공개
VLM은 한국 공공기관 문서를 얼마나 잘 읽을까? KOLongDoc 벤치마크 공개 | GeekNews
<p>🔥 한국어 Long-Document VLM 벤치마크, <a href="https://github.com/Marker-Inc-Korea/KOLongDoc">KOLongDoc</a>를 공개했습니다!</p> <p>최근 ChatGPT, Claude, Gemini 같은 멀티모달 AI가 공공·행정 업무에도 활용되기 시작했지만,…
-
Show GN: TxtAIEditor - AI 에이전트와 Markdown/html 미리보기를 탑재한 Windows 텍스트 에디터
<p>TxtAIEditor는 .NET 10.0 및 WinUI 3의 강력한 윈도우 네이티브 성능 위에, WebView2 기반의 커스텀 코어를 융합하여 유연한 렌더링 기능을 결합한 프리미엄 데스크톱 에디터입니다.마크다운 작성, AI 협업, 간단한 CSV 편집까지 개발자와 파워 유저에게 필요한 유용한 기능들을 유기적으로 통합했…
-
Project Capture - 웹 프로젝트 화면 캡처를 자동화하는 AI 에이전트용 스킬
Project Capture - 웹 프로젝트 화면 캡처를 자동화하는 AI 에이전트용 스킬 | GeekNews
<p>웹 프로젝트 화면 캡처를 반복해서 하다 보니, 라우트 확인, 로그인 처리, 캡처 범위 선택, 결과 정리를 매번 수동으로 하는 게 번거로워서 만들었습니다.</p> <p><code>project-capture</code>는 AI 코딩 에이전트가 프로젝트를 먼저 분석한 뒤, 어떤 화면을 캡처할지 사용자에게 확인하고 Pla…
-
[AINews] Reve 2와 Ideogram 4: 이미지 생성의 레이아웃
[AINews] Reve 2 and Ideogram 4: Layouts in Imagegen
a quiet day.