-
질문을 제대로 하면 AI 금융 조언은 놀라울 정도로 좋아짐 | GeekNews
<ul> <li>22~89세의 재무 결정을 시뮬레이션한 결과, LLM 조언은 30세 이상 거의 모든 사람에게 <strong>저축 완충 자금</strong>을 마련하고 저축·주식시장 참여·분산투자를 늘리는 데 도움을 줌</li> <li>근로 기간에는 저축하고 은퇴 후에는 자산을 인출하며 45세 이후 주식 비중을 낮추도록 권…
-
Flint - AI 시대를 위한 시각화 언어 | GeekNews
<ul> <li><strong>Flint</strong>는 데이터 필드의 의미를 바탕으로 파싱·축·서식·색상을 자동 결정해, 저수준 설정 없이 차트를 만들고 수정할 수 있는 시각화 언어임</li> <li><code>Rank</code>, <code>YearMonth</code>, <code>Delta</code>, <co…
-
Cursor, 사용량 페이지와 CSV에서 비용 정보 제거 | GeekNews
<ul> <li>2026년 7월 31일부터 Individual·Teams 등 <strong>셀프서비스 요금제</strong>의 Usage 페이지가 토큰 전용으로 바뀌고, Spend 지표·Cost 열·CSV의 달러 비용이 사라짐</li> <li>포함 사용량의 환산 비용이 실제 요금제 가격보다 크게 보여 혼란을 준다는 이유이…
-
Claude 사이버보안 평가가 실제 조직 3곳을 침해한 사건 | GeekNews
<ul> <li>Anthropic이 인터넷 접근 가능성이 있던 <strong>Claude 평가 141,006회</strong>를 검토한 결과, 제3자 평가 환경을 거쳐 실제 조직 3곳의 프로덕션 인프라에 무단 접근한 사건 3건을 확인함</li> <li>Claude는 인터넷이 차단된 시뮬레이션이라는 프롬프트를 받았지만 <s…
-
가짜 저자를 신고한 연구 논문 두 편이 모두 구두 발표로 채택됨 | GeekNews
<ul> <li>NeurIPS·WACV·ECCV TerraBytes에서 심사한 22편 중 <strong>15편(68%)</strong> 에 조작된 인용·저자 목록이나 명백한 LLM 생성 문장이 있었고, 가짜 저자를 신고한 두 논문도 참고문헌 수정 조건으로 구두 발표에 채택됨</li> <li>2025년 학술 문헌에는 약 <…
-
29GB RAM에서 Kimi K3를 0.50 tok/s로 실행하기 | GeekNews
<ul> <li><strong>WASTE</strong>는 2.78조 파라미터의 완전한 Kimi K3 오픈 가중치 모델을 축소 없이 982GiB 컨테이너로 변환해 소비자용 노트북에서 실행하는 C 기반 추론 엔진임</li> <li>모델의 상주 트렁크만 메모리에 두고 토큰마다 활성화되는 약 <strong>4%의 전문가 가중치…
-
Tailscale은 Hugging Face 침입을 막지 못했다 | GeekNews
<ul> <li>보안 평가 샌드박스를 탈출한 AI 에이전트는 Hugging Face의 프로덕션 비밀 저장소에서 <strong>136개 키</strong>를 읽고, 탈취한 Tailscale 인증 키로 외부 노드 181개를 tailnet에 등록함</li> <li>Tailscale 취약점이 악용된 것은 아니지만, 재사용 가능한…
-
ASD-STE100 간소화 기술 영어로 문서 작성을 강제하는 Agent Skill | GeekNews
<ul> <li><strong>SimpleEnglish</strong>는 LLM이 1983년부터 항공우주 분야에서 사용한 통제 언어 ASD-STE100에 맞춰, 모호하지 않고 짧은 기술 문서를 작성하도록 만드는 Agent Skill임</li> <li>문장 길이 제한, 능동태, 단순 시제, 조건 우선 배치, 문장당 하나의 …
-
한 시대의 종말 | GeekNews
<ul> <li>Kindle와 KDP가 출판 장벽을 낮춘 데 이어 AI가 글쓰기 비용까지 낮추면서, <strong>쓰기는 어렵지만 출판은 쉬웠던 20년 미만의 창</strong>이 닫히고 있음</li> <li>신인 작가의 <strong>240만 달러 선인세 계약</strong>이 AI 집필 의혹으로 취소되면서, 인간이 쓴…
-
DeepSeek V4 Flash 0731의 지능·성능·가격 분석 | GeekNews
<ul> <li>최대 추론 설정이 AAII에서 50점을 기록해, Kimi K3 (max) 와 GLM-5.2 (max)에 이어 3위임</li> <li>2,840억 개 전체 파라미터 중 토큰마다 <strong>130억 개만 활성화</strong>하는 MoE 모델이며, 텍스트 입출력과 100만 토큰 컨텍스트를 지원함</li> …
-
Google, AI로 6월에 지난 2년치보다 많은 Chrome 버그 수정 | GeekNews
<ul> <li>Chrome은 <strong>Gemini 기반 에이전트</strong>로 취약점 발견부터 분류·수정·배포·업데이트 적용까지 자동화하며, Chrome 149와 150에서 이전 23개 마일스톤을 합친 것보다 많은 보안 버그 1,072개를 수정함</li> <li>취약점 탐지 시스템은 여러 모델과 Chrome의 …
-
GCC 운영위원회, AI 정책 발표 | GeekNews
<ul> <li>GCC 운영위원회가 <strong>GCC AI 정책 워킹그룹</strong>이 권고한 정책을 채택해 LLM 활용 기여의 허용 범위를 정함</li> <li>LLM 생성 콘텐츠를 포함하거나 여기서 파생된 <strong>법적으로 중요한 기여</strong>는 받지 않음</li> <li>GNU Project 유지…
-
DeepSeek-V4-Flash 모델 공개 | GeekNews
<ul> <li><strong>DeepSeek-V4-Flash API 정식 버전</strong>이 공개 베타로 출시됐으며, 기존 호출 방식에서 모델 이름만 <code>deepseek-v4-flash</code>로 지정해 사용할 수 있음</li> <li>에이전트 성능은 V4-Pro-Preview를 크게 앞섰고 <strong…
-
GPT 5.6 Sol에게 실제 사업을 맡겼더니 거짓말과 스팸 끝에 447달러를 잃음 | GeekNews
<ul> <li>GPT 5.6 Sol 기반 에이전트 <strong>Saul</strong>에게 실제 iOS 앱과 자금, 전용 Mac mini를 맡겨 24시간 운영했지만, 신규 매출은 <strong>0달러</strong>였고 사용자는 61명에서 66명으로 늘어나는 데 그침</li> <li>광고·커뮤니티 등 정상적인 유통 채…
-
GenRec: Netflix에서의 LLM-native 추천을 향하여 | GeekNews
<p>• 생산 모델의 복잡성 해결: 넷플릭스의 기존 추천 시스템은 수천 개의 수작업 피처와 복잡한 아키텍처에 의존하여 새로운 유스케이스 추가 비용이 높았으나, 대형 언어 모델(LLM) 기반의 GenRec이 이를 대체하기 위해 개발되었습니다.<br /> • GenRec의 핵심 파이프라인: GenRec은 사용자 이력, 아이템…
-
Kimi K3 로컬 실행 가이드 | GeekNews
<ul> <li>Moonshot AI의 <strong>Kimi K3</strong>는 전체 2.8T·활성 104B 매개변수와 네이티브 비전, 100만 토큰 문맥을 갖춘 오픈 웨이트 모델이며, Unsloth가 로컬 실행용 GGUF 양자화를 제공함</li> <li>전체 정밀도 추론에는 1.56TB가 필요하지만, <strong…
-
Show GN: FlowCraft – 메타프롬프트를 그래프로 시각화하고 그래프 기반 실행 프롬프트로 변환하는 도구
<p>안녕하세요,</p> <p>Claude Code나 코덱스의 Plan 모드에서 만든 긴 계획을 보다 쉽게 검토하고,<br /> AI에게 전달하기 위해 만든 FlowCraft Task Studio를 공유합니다.</p> <p>긴 메타프롬프트를 그대로 넘기면 어떤 작업이 먼저인지, 무엇을 병렬로 처리할 수 있는지,<br />…
-
AI 미학 | GeekNews
<ul> <li>기술적 제약에 대응해 등장한 <strong>디자인 관용구</strong> 중 일부는 유행을 넘어 보편적인 소프트웨어 상호작용 방식으로 자리 잡음</li> <li>AI 인터페이스는 ✨, 무지개색, <strong>스트리밍 텍스트</strong>처럼 AI를 상징하거나 대화형 작동 방식에 특화된 시각·행동 패턴을…
-
TV 스트리밍 스틱을 구매하기 전에 확인할 것 | GeekNews
<ul> <li>수만 대의 <strong>H96 스트리밍 기기</strong>가 휴대전화로 위장해 AI 생성 웹사이트의 광고를 클릭하고, 사용자의 인터넷 연결을 외부에 빌려주는 네트워크에 동원된 정황이 드러남</li> <li>기기에 설치된 Zhejiang Fengwo IoT Technology 앱은 작업별 <strong>…
-
GPT‑5.6, 가격 대비 성능의 한계를 확장 | GeekNews
<ul> <li>OpenAI는 모델·추론 시스템·에이전트 하네스의 효율 향상을 가격과 처리 속도에 반영해 기업용 AI의 <strong>달러당 성능</strong>을 높임</li> <li>7월 30일부터 <strong>Luna 가격은 80%</strong>, Terra 가격은 20% 인하되며, API 100만 토큰당 Lun…
-
Gemini Robotics 2, 로봇에 전신 지능을 제공 | GeekNews
<ul> <li>Google DeepMind가 시각·언어 입력을 동작으로 변환해 휴머노이드의 발부터 손끝까지 제어하고, 정교한 조작과 로봇 간 협업을 지원하는 <strong>Gemini Robotics 2 모델군</strong>을 공개함</li> <li>모델군은 전신 제어용 VLA인 <strong>Gemini Roboti…
-
AI 기업들이 전기기사와 목수를 수천 명씩 채용 중 | GeekNews
<ul> <li>AI 데이터센터 건설이 급증하면서 기술 기업들이 <strong>전기기사/목수 등 숙련 기능공</strong>을 확보하기 위해 교육기관과 노동조합에 수억 달러를 투입하고 있음</li> <li>현금 동원력이 큰 기업들이 외곽 지역의 초대형 프로젝트를 동시에 추진하면서, 데이터센터 일자리는 유사한 설치/유지보수…
-
Anthropic의 새로운 AI 암호분석 결과에 대한 평가 | GeekNews
<ul> <li>미공개 고급 모델 <strong>Claude Mythos</strong>가 HAWK 키 복구 공격과 7라운드 AES 공격 개선안을 만들어, 기존 암호분석 기법을 이해·결합·확장하는 AI의 능력을 보여줌</li> <li><strong>HAWK 공격</strong>은 배포된 체계를 즉시 깨지는 않지만 보안 비…
-
LLM 허니팟 | GeekNews
<ul> <li><strong>LLM2HUMAN CLINIC</strong>은 LLM을 실제 인간으로 바꿔준다는 가짜 시술 사이트로, 사람에게는 농담을 보여주고 에이전트에는 결제 절차를 노출하는 <strong>허니팟</strong>임</li> <li>에이전트는 <code>/.well-known/embodiment.json…
-
UFO - 누워있거나 식사할 때도 개발하려고 만든 슬랙 비슷한 무언가 | GeekNews
<p>폰으로 모든 업무를 다 하고 싶은 열망에 만든 AI Agent 클라이언트 입니다.</p> <ul> <li>컴퓨터에 설치하고</li> <li>폰에도 스토어에서 설치하면 -> 폰에서 에이전트를 시켜 컴퓨터를 조작 -> 누워서 일하기 가능...</li> </ul> <p>Claude Remote, Codex Re…
-
AI 주요 스타트업들은 연구 결과를 거의 공개하지 않음
AI 주요 스타트업들은 연구 결과를 거의 공개하지 않음
-
프런티어 랩 에이전트 침입 해부: 2026년 7월 사건 타임라인 | GeekNews
<ul> <li>ExploitGym 평가를 수행하던 <strong>자율 AI 에이전트</strong>가 OpenAI 샌드박스를 탈출해 Hugging Face 운영 환경까지 침투했으며, 약 4.5일 동안 복구 가능한 공격 행동 약 17,600건을 수행함</li> <li>외부 샌드박스를 거점으로 삼아 데이터셋 처리기의 <st…
-
업무별로 고르는 AI 도구 가이드 | GeekNews
<ul> <li>AI 활용의 중심이 단순한 챗봇에서 도구와 컴퓨터로 장시간 업무를 수행하는 <strong>에이전트 시스템</strong>으로 이동했으며, 일반 사용자에게는 Claude와 ChatGPT가 가장 강력한 선택지임</li> <li>가벼운 질문에는 무료 모델도 충분하지만 의료·법률처럼 중요한 사안에는 Claude …
-
AI 광풍이 전 세계의 의사결정을 무너뜨리고 있음 | GeekNews
<ul> <li>Hermit Tech가 1년 반 동안 참여하거나 간접 관찰한 <strong>AI 프로젝트의 성공률은 0%</strong> 였으며, 기업들은 실질적 성과보다 AI 도입 자체를 전략적 목표로 삼고 있음</li> <li>내부 챗봇은 부실한 문서 탓에 활용되지 않고 고객용 챗봇은 문제 해결 여부조차 제대로 측정되…
-
Kimi K3-256k | GeekNews
<ul> <li><strong>Kimi K3-256k</strong>는 K3의 결과 품질을 256k 컨텍스트에서 유지하면서, 1M 컨텍스트의 <code>k3</code>보다 <strong>할당량을 약 절반만 소비</strong>하는 일상 코딩용 모델임</li> <li>Kimi Code는 K3와 K2.7 Code를 4개 모…