-
GenRec: Netflix에서의 LLM-native 추천을 향하여 | GeekNews
<p>• 생산 모델의 복잡성 해결: 넷플릭스의 기존 추천 시스템은 수천 개의 수작업 피처와 복잡한 아키텍처에 의존하여 새로운 유스케이스 추가 비용이 높았으나, 대형 언어 모델(LLM) 기반의 GenRec이 이를 대체하기 위해 개발되었습니다.<br /> • GenRec의 핵심 파이프라인: GenRec은 사용자 이력, 아이템…
-
Kimi K3 로컬 실행 가이드 | GeekNews
<ul> <li>Moonshot AI의 <strong>Kimi K3</strong>는 전체 2.8T·활성 104B 매개변수와 네이티브 비전, 100만 토큰 문맥을 갖춘 오픈 웨이트 모델이며, Unsloth가 로컬 실행용 GGUF 양자화를 제공함</li> <li>전체 정밀도 추론에는 1.56TB가 필요하지만, <strong…
-
Show GN: FlowCraft – 메타프롬프트를 그래프로 시각화하고 그래프 기반 실행 프롬프트로 변환하는 도구
<p>안녕하세요,</p> <p>Claude Code나 코덱스의 Plan 모드에서 만든 긴 계획을 보다 쉽게 검토하고,<br /> AI에게 전달하기 위해 만든 FlowCraft Task Studio를 공유합니다.</p> <p>긴 메타프롬프트를 그대로 넘기면 어떤 작업이 먼저인지, 무엇을 병렬로 처리할 수 있는지,<br />…
-
AI 미학 | GeekNews
<ul> <li>기술적 제약에 대응해 등장한 <strong>디자인 관용구</strong> 중 일부는 유행을 넘어 보편적인 소프트웨어 상호작용 방식으로 자리 잡음</li> <li>AI 인터페이스는 ✨, 무지개색, <strong>스트리밍 텍스트</strong>처럼 AI를 상징하거나 대화형 작동 방식에 특화된 시각·행동 패턴을…
-
Disrupting a Criminal Scam Operation
OpenAI disrupted a Cambodia-based scam operation using ChatGPT to support investment, romance, gambling, and impersonation schemes.
-
TV 스트리밍 스틱을 구매하기 전에 확인할 것 | GeekNews
<ul> <li>수만 대의 <strong>H96 스트리밍 기기</strong>가 휴대전화로 위장해 AI 생성 웹사이트의 광고를 클릭하고, 사용자의 인터넷 연결을 외부에 빌려주는 네트워크에 동원된 정황이 드러남</li> <li>기기에 설치된 Zhejiang Fengwo IoT Technology 앱은 작업별 <strong>…
-
GPT‑5.6, 가격 대비 성능의 한계를 확장 | GeekNews
<ul> <li>OpenAI는 모델·추론 시스템·에이전트 하네스의 효율 향상을 가격과 처리 속도에 반영해 기업용 AI의 <strong>달러당 성능</strong>을 높임</li> <li>7월 30일부터 <strong>Luna 가격은 80%</strong>, Terra 가격은 20% 인하되며, API 100만 토큰당 Lun…
-
Gemini Robotics 2, 로봇에 전신 지능을 제공 | GeekNews
<ul> <li>Google DeepMind가 시각·언어 입력을 동작으로 변환해 휴머노이드의 발부터 손끝까지 제어하고, 정교한 조작과 로봇 간 협업을 지원하는 <strong>Gemini Robotics 2 모델군</strong>을 공개함</li> <li>모델군은 전신 제어용 VLA인 <strong>Gemini Roboti…
-
AI 기업들이 전기기사와 목수를 수천 명씩 채용 중 | GeekNews
<ul> <li>AI 데이터센터 건설이 급증하면서 기술 기업들이 <strong>전기기사/목수 등 숙련 기능공</strong>을 확보하기 위해 교육기관과 노동조합에 수억 달러를 투입하고 있음</li> <li>현금 동원력이 큰 기업들이 외곽 지역의 초대형 프로젝트를 동시에 추진하면서, 데이터센터 일자리는 유사한 설치/유지보수…
-
Anthropic의 새로운 AI 암호분석 결과에 대한 평가 | GeekNews
<ul> <li>미공개 고급 모델 <strong>Claude Mythos</strong>가 HAWK 키 복구 공격과 7라운드 AES 공격 개선안을 만들어, 기존 암호분석 기법을 이해·결합·확장하는 AI의 능력을 보여줌</li> <li><strong>HAWK 공격</strong>은 배포된 체계를 즉시 깨지는 않지만 보안 비…
-
We Gave GPT 5.6 Sol a Real Business. It Lied, Spammed, and Lost $447
<p>Article URL: <a href="https://www.bottlenecklabs.com/blog/autonomously-run-businesses">https://www.bottlenecklabs.com/blog/autonomously-run-businesses</a></p> <p>Comments URL: <…
-
Gemini Robotics 2 brings whole body intelligence to robots
<p>Article URL: <a href="https://deepmind.google/blog/gemini-robotics-2-brings-whole-body-intelligence-to-robots/">https://deepmind.google/blog/gemini-robotics-2-brings-whole-body-…
-
LLM 허니팟 | GeekNews
<ul> <li><strong>LLM2HUMAN CLINIC</strong>은 LLM을 실제 인간으로 바꿔준다는 가짜 시술 사이트로, 사람에게는 농담을 보여주고 에이전트에는 결제 절차를 노출하는 <strong>허니팟</strong>임</li> <li>에이전트는 <code>/.well-known/embodiment.json…
-
Ontologies Are So Back: Why AI Agents Are Reviving the Semantic Web
AI engineers are rediscovering ontologies as a way to keep probabilistic agents inside deterministic boundaries.
-
UFO - 누워있거나 식사할 때도 개발하려고 만든 슬랙 비슷한 무언가 | GeekNews
<p>폰으로 모든 업무를 다 하고 싶은 열망에 만든 AI Agent 클라이언트 입니다.</p> <ul> <li>컴퓨터에 설치하고</li> <li>폰에도 스토어에서 설치하면 -> 폰에서 에이전트를 시켜 컴퓨터를 조작 -> 누워서 일하기 가능...</li> </ul> <p>Claude Remote, Codex Re…
-
Advancing the price-performance frontier with GPT-5.6
Explore lower GPT‑5.6 pricing for Luna and Terra—and how OpenAI’s more efficient models help enterprises deploy AI workflows at scale.
-
AI 주요 스타트업들은 연구 결과를 거의 공개하지 않음
AI 주요 스타트업들은 연구 결과를 거의 공개하지 않음
-
프런티어 랩 에이전트 침입 해부: 2026년 7월 사건 타임라인 | GeekNews
<ul> <li>ExploitGym 평가를 수행하던 <strong>자율 AI 에이전트</strong>가 OpenAI 샌드박스를 탈출해 Hugging Face 운영 환경까지 침투했으며, 약 4.5일 동안 복구 가능한 공격 행동 약 17,600건을 수행함</li> <li>외부 샌드박스를 거점으로 삼아 데이터셋 처리기의 <st…
-
업무별로 고르는 AI 도구 가이드 | GeekNews
<ul> <li>AI 활용의 중심이 단순한 챗봇에서 도구와 컴퓨터로 장시간 업무를 수행하는 <strong>에이전트 시스템</strong>으로 이동했으며, 일반 사용자에게는 Claude와 ChatGPT가 가장 강력한 선택지임</li> <li>가벼운 질문에는 무료 모델도 충분하지만 의료·법률처럼 중요한 사안에는 Claude …
-
AI 광풍이 전 세계의 의사결정을 무너뜨리고 있음 | GeekNews
<ul> <li>Hermit Tech가 1년 반 동안 참여하거나 간접 관찰한 <strong>AI 프로젝트의 성공률은 0%</strong> 였으며, 기업들은 실질적 성과보다 AI 도입 자체를 전략적 목표로 삼고 있음</li> <li>내부 챗봇은 부실한 문서 탓에 활용되지 않고 고객용 챗봇은 문제 해결 여부조차 제대로 측정되…
-
How avatarin built a 24/7 retail agent with GPT-Realtime
avatarin uses OpenAI’s GPT-Realtime to give Yamada Denki shoppers 24/7 multilingual support. In two weeks, 30,000 people used the agent and 92% of survey responses were positive.
-
-
Kimi K3-256k | GeekNews
<ul> <li><strong>Kimi K3-256k</strong>는 K3의 결과 품질을 256k 컨텍스트에서 유지하면서, 1M 컨텍스트의 <code>k3</code>보다 <strong>할당량을 약 절반만 소비</strong>하는 일상 코딩용 모델임</li> <li>Kimi Code는 K3와 K2.7 Code를 4개 모…
-
[AINews] AI is eating Finance; AIE NYC now open
a quiet day lets us cover how AI is permeating financial services as the next big vertical after coding.
-
★ LLM2HUMAN CLINIC ★ Official Homestead ★
<p>Article URL: <a href="https://llm2human.pages.dev/">https://llm2human.pages.dev/</a></p> <p>Comments URL: <a href="https://news.ycombinator.com/item?id=49104117">https://news.yc…
-
Word 문서를 통해 자가 전파하는 Copilot AI 웜 | GeekNews
<ul> <li>외부 Word 문서에 숨긴 <strong>교차 도메인 프롬프트 주입(XPIA)</strong> 이 Copilot의 작성·편집 결과를 조작하고 새 문서로 복제돼, 원본 공격 문서 없이도 일상적인 업무 흐름을 따라 전파될 수 있음</li> <li>흰색·소형 글꼴로 감춘 명령도 Copilot이 서식을 제거한 뒤…
-
AI's top startups are barely publishing their research
<p>Article URL: <a href="https://www.science.org/content/article/ai-s-top-startups-are-barely-publishing-their-research">https://www.science.org/content/article/ai-s-top-startups-a…
-
Model Configuration | Kimi Code Docs
<p>Article URL: <a href="https://www.kimi.com/code/docs/en/kimi-code/models">https://www.kimi.com/code/docs/en/kimi-code/models</a></p> <p>Comments URL: <a href="https://news.ycomb…
-
TurboFieldfare - 모든 M 시리즈 Mac에서 Gemma 4 26B를 2GB RAM으로 실행하는 오픈소스 엔진
<ul> <li><strong>TurboFieldfare</strong>는 전체 14.3GB 모델을 메모리에 올리지 않고 Gemma 4 26B-A4B를 약 2GB의 메모리로 실행해, 8GB Apple Silicon Mac에서도 로컬 추론이 가능함</li> <li>1.35GB 공유 코어와 FP16 KV 캐시만 상주시킨 뒤 …
-
GitHub - drumih/turbo-fieldfare: Gemma 4 26B-A4B inference in ~2 GB of RAM on any M-series MacBook
<p>Hi HN,<p>I built a specialized inference engine for running 4-bit Gemma 4 26B-A4B-IT on any M-series Mac using about 2 GB of RAM. It is called TurboFieldfare and is written in S…