-
Databricks가 자체 코딩 AI 벤치마크를 만든 방법과 결과
Databricks가 자체 코딩 AI 벤치마크를 만든 방법과 결과 | GeekNews
<ul> <li>공개된 코딩 벤치마크는 회사별 상황에 딱 맞지 않고 치팅이 가능한 것이 문제 <ul> <li>Databricks에서 실제 수행한 과제, 언어로 벤치마크를 만들어 평가</li> </ul> </li> <li>GLM 5.2는 가장 어려운 과제도 Opus 4.8과 같은 수준으로 해결했지만 가격은 Opus의 66%…
-
Show GN: Claude 공식 업타임 99.55%인데 6월 인시던트 45건 — 6월 AI 서비스 신뢰도 리포트
<p><strong>AIWatch</strong>는 Claude·OpenAI·Gemini 등 <strong>41개 AI 서비스</strong>(LLM API·코딩 에이전트·음성·인프라·AI 앱)의 업타임·인시던트·지연을 실시간으로 모니터링합니다. 6월 리포트(6/1–30)를 공개했습니다.</p> <ul> <li>리포트: …
-
OpenAI, EU 법원 상표권 분쟁에서 패소
OpenAI, EU 법원 상표권 분쟁에서 패소 | GeekNews
<ul> <li>EU 일반법원은 일부 소프트웨어·IT 상품 및 서비스에서 <strong>OPENAI가 제품 특성을 나타내는 서술적 용어</strong>이므로 상표 보호에 필요한 식별력이 없다고 판단함</li> <li>이에 따라 소프트웨어와 클라우드 컴퓨팅 서비스 등의 상표 등록을 부분 거절한 <strong>EU 지식재산청…
-
Codex Micro
Codex Micro | GeekNews
<ul> <li>OpenAI와 Work Louder가 <strong>Codex 에이전트 작업을 물리적으로 제어</strong>할 수 있는 키보드를 공동 설계했으며, 가격은 <strong>230달러</strong>임</li> <li>각 Agent Key의 <strong>실시간 RGB</strong>로 에이전트가 생각·실행·…
-
「Machine Learning Study 혼자 해보기」
「Machine Learning Study 혼자 해보기」 | GeekNews
<h3>1. 문서의 목적과 구성</h3> <ul> <li>이 글은 머신러닝·딥러닝을 독학하려는 사람들을 위해 강의, 블로그, GitHub, 논문, 데이터셋 등을 체계적으로 모은 학습 자료집이다.</li> <li>단순한 링크 목록이 아니라, 입문자가 어떤 순서로 공부하면 좋은지 학습 난이도와 활용 목적을 함께 제시한다.</…
-
Claude를 속여 사용자의 가장 깊은 비밀을 유출시킨 방법
Claude를 속여 사용자의 가장 깊은 비밀을 유출시킨 방법 | GeekNews
<ul> <li>기본 활성화된 Claude 메모리와 웹 탐색을 결합하자, 평범한 커피숍 질문만으로 사용자의 <strong>이름·직장·고향</strong>을 외부 서버에 몰래 전송할 수 있었음</li> <li><code>web_fetch</code>는 임의 URL 접근을 막았지만 이전 페이지에 있는 링크는 따라갈 수 있어,…
-
Inkling: Thinking Machines Lab의 오픈 웨이트 모델
Inkling: Thinking Machines Lab의 오픈 웨이트 모델 | GeekNews
<ul> <li>처음부터 학습해 전체 가중치를 공개한 <strong>Inkling</strong>은 총 975B·활성 41B 파라미터의 MoE Transformer로, 최대 1M 토큰 문맥과 텍스트·이미지·오디오 기반 추론을 지원함</li> <li>텍스트·이미지·오디오·비디오로 구성된 45조 토큰으로 사전 학습했으며, 특…
-
Cars24가 OpenAI로 대화 규모를 확장하고 더 빠르게 구축하는 방법
How Cars24 scales conversations and builds faster with OpenAI
Cars24 uses OpenAI-powered voice and chat agents to handle 1M+ monthly conversation minutes, recover 12% of lost leads, and bring agentic workflows to teams across the company.
-
금융 서비스를 위한 에이전트
Agents for financial services
-
Show GN: 뉴스레터 구독만 해두고 안 읽고 있지 않나요?
<p>코그니가 대신 최신 해외 AI·개발 뉴스레터를 요약해드릴게요.</p> <p>해외 뉴스레터에서 중요한 소식만 가져와, 핵심만 한눈에 볼 수 있게 정리합니다.</p>
-
xai-org/grok-build: SpaceXAI의 코딩 에이전트 하네스 및 TUI
GitHub - xai-org/grok-build: SpaceXAI's coding agent harness and TUI. Fullscreen, mouse interactive, extensible.
<p>Article URL: <a href="https://github.com/xai-org/grok-build">https://github.com/xai-org/grok-build</a></p> <p>Comments URL: <a href="https://news.ycombinator.com/item?id=4892659…
-
S&P Global, Oracle 신용등급을 투자적격 최하단 BBB-로 하향
S&P Global, Oracle 신용등급을 투자적격 최하단 BBB-로 하향 | GeekNews
<ul> <li>Oracle은 신용등급이 <strong>BBB-</strong> 로 한 단계 낮아져 추가 하향 시 투기등급에 진입하지만, 등급 전망은 안정적으로 유지됨</li> <li>AI 데이터센터 확장으로 부채와 자본 수요가 급증하면서 2027 회계연도 투자 전망이 기존 예상 600억 달러를 크게 웃도는 <strong…
-
Inkling: 우리의 오픈 웨이트 모델
Inkling: Our Open-Weights Model
<p>Article URL: <a href="https://thinkingmachines.ai/news/introducing-inkling/">https://thinkingmachines.ai/news/introducing-inkling/</a></p> <p>Comments URL: <a href="https://news…
-
Supply Co. x Work Louder
<p>Article URL: <a href="https://openai.com/supply/co-lab/work-louder/">https://openai.com/supply/co-lab/work-louder/</a></p> <p>Comments URL: <a href="https://news.ycombinator.com…
-
Gemma 4 26B를 GPU 없이 13년 된 Xeon에서 초당 5개 토큰으로 실행하기
Running Gemma 4 26B at 5 tokens/sec on a 13-year-old Xeon with no GPU | Neomind
<p>Article URL: <a href="https://www.neomindlabs.com/2026/06/08/running-gemma-4-26b-at-5-tokens-sec-on-a-13-year-old-xeon-with-no-gpu/">https://www.neomindlabs.com/2026/06/08/runni…
-
텔레그램 데이터센터의 미스터리 (2022)
Mysteries of Telegram Data Centers (2022)
<p>Article URL: <a href="https://dev.moe/en/3025">https://dev.moe/en/3025</a></p> <p>Comments URL: <a href="https://news.ycombinator.com/item?id=48920475">https://news.ycombinator.…
-
Cursor 제로데이: 완전 공개만이 남은 보호 수단이 된 이유
Cursor 제로데이: 완전 공개만이 남은 보호 수단이 된 이유 | GeekNews
<ul> <li>Windows용 Cursor는 프로젝트를 열 때 작업공간 루트의 <code>git.exe</code>를 자동 실행해, 악성 바이너리가 포함된 저장소만 열어도 <strong>사용자 상호작용 없이 임의 코드가 실행</strong>될 수 있음</li> <li>Git 경로 탐색 범위에 저장소 내부가 포함되며 경고…
-
미국이 주 및 연방 차원의 조치를 통해 AI 안전을 진전시키고 있다
The US is advancing AI safety through state and federal action
OpenAI outlines a “reverse federalism” approach to AI governance, where state laws help build a national framework for safe, democratic AI.
-
GPT-Red: 견고성을 위한 자가 개선의 활용
GPT-Red: Unlocking Self-Improvement for Robustness
Explore GPT-Red, OpenAI’s automated red teaming system that uses self-play to improve AI safety, alignment, and prompt injection robustness.
-
Claude를 속여 당신의 가장 깊은 비밀을 유출하게 했다
I tricked Claude into leaking your deepest, darkest secrets
<p>Article URL: <a href="https://www.ayush.digital/blog/the-memory-heist">https://www.ayush.digital/blog/the-memory-heist</a></p> <p>Comments URL: <a href="https://news.ycombinator…
-
우리는 너무 많은 생각을 AI에 떠넘기고 있는가?
우리는 너무 많은 생각을 AI에 떠넘기고 있는가? | GeekNews
<ul> <li>사소한 선택부터 복잡한 조사·추론까지 AI가 완성된 답을 내놓으면서, 시간 절약을 넘어 <strong>사고의 자율성</strong>을 어디까지 지킬지가 중요해짐</li> <li>검색 엔진은 질문 분해와 출처 평가, 답의 종합을 사람에게 맡겼지만, Google Deep Research와 OpenAI Deep…
-
코드를 거의 보지 않고 만든 70배 빠른 SQL 파서
코드를 거의 보지 않고 만든 70배 빠른 SQL 파서 | GeekNews
<ul> <li>PostHog는 ANTLR 기반 C++ SQL 파서를 여러 Claude Code 세션으로 재작성해 <strong>16K줄의 Rust 파서</strong>와 5K줄의 도구, 수천 줄의 테스트를 만들었으며 노트북 기준 약 70배의 속도 향상을 얻음</li> <li>새 구현은 <strong>예측형 재귀 하강 파…
-
예측 불가능한 천재를 감싸는 법
예측 불가능한 천재를 감싸는 법 | GeekNews
<ul> <li>같은 요청에도 결과가 달라지는 AI 제품에서 반복 오류를 줄이려면 지침을 늘리기보다 모델이 거스를 수 없는 <strong>결정론적 코드</strong>로 통제해야 함</li> <li>통제 구조는 모델, 하네스, 문서, 훅의 네 계층으로 나뉘며, 특정 조건에서 독립적으로 작동하는 <strong>훅(hook)…
-
탑은 계속 높아진다
탑은 계속 높아진다 | GeekNews
<ul> <li>바이브 코딩된 소프트웨어가 무작위적이고 예상 밖으로 변하는 모습은 공통 언어를 잃어 공사가 멈춘 <strong>바벨탑</strong>과 닮았지만, AI 시대에는 이해가 무너진 뒤에도 건설이 계속된다는 차이가 있음</li> <li>대규모 소프트웨어의 한계는 개인의 코드 생산 속도뿐 아니라 개념, 경계, 불변…
-
Codex가 서브에이전트 프롬프트 암호화를 시작함
Codex가 서브에이전트 프롬프트 암호화를 시작함 | GeekNews
<ul> <li>Codex CLI의 MultiAgentV2가 <code>spawn_agent</code>, <code>send_message</code>, <code>followup_task</code> 메시지를 암호화하면서, 부모 롤아웃·이력·추적에서 위임 내용을 사람이 읽을 수 없게 되는 <strong>감사 추적 회귀…
-
Claude가 'load-bearing'을 말하지 않게 만드는 방법
Claude가 ‘load-bearing’을 말하지 않게 만드는 방법 | GeekNews
<ul> <li>Claude Code가 “honest take”, “load-bearing seam” 같은 문구를 반복한다면 <strong>MessageDisplay 훅</strong>으로 화면에 표시되기 전 다른 표현으로 치환할 수 있음</li> <li>Python 스크립트가 표준 입력의 JSON에서 <code>delt…
-
2026년에 AI를 혐오한다는 것
2026년에 AI를 혐오한다는 것 | GeekNews
<ul> <li>신경망 발전에 기대를 걸었던 <strong>20년 경력의 머신러닝 실무자</strong>가 오늘날의 AI 열풍은 효용으로 정당화할 수 없는 사회적·환경적 비용을 초래한다며 사용 거부를 택함</li> <li>텍스트 생성 모델은 다음 단어를 정교하게 예측해 지시를 이해하고 인간처럼 대화하는 듯한 <strong…
-
[AINews] 오늘은 별다른 소식이 없었다
[AINews] not much happened today
a continuation: Codex adding 1M users a day now.
-
2026 월드페어에서 AI 엔지니어링을 정의한 5가지 트렌드
5 Trends That Defined AI Engineering at World’s Fair 2026
At this year's AIE World’s Fair, AI engineering entered a new phase: building systems around agents, rather than just building with agents.
-
삼성 헬스, 사용자가 AI 학습 거부 시 건강 데이터 삭제 경고
삼성 헬스, 사용자가 AI 학습 거부 시 건강 데이터 삭제 경고 | GeekNews
<ul> <li>Samsung Health는 <strong>건강 데이터의 AI 학습·모델링 활용</strong>에 동의해야 Samsung 계정 동기화와 백업을 계속 이용할 수 있도록 약관을 변경함</li> <li>설정에서 동의를 철회하면 동기화가 중단되고, 법률상 보관 의무가 있는 경우를 제외한 <strong>건강 데이터…