-
대규모 언어 모델의 마음 지도 그리기
Mapping the mind of a large language model
-
Lilian Weng이 정리한 RSI 하네스 엔지니어링 35편 논문 요약
[AINews] Lilian Weng summarizes 35 papers on Harness Engineering for RSI
a quiet day lets us read some condensed insight
-
30 Papers - 일리야 서츠케버 추천 AI 핵심 논문 목록 요약
30 Papers - 일리야 서츠케버 추천 AI 핵심 논문 목록 요약 | GeekNews
<ul> <li>일리야 서츠케버가 존 카맥에게 추천했다고 알려진 AI 핵심 논문 목록을 바탕으로, 머신러닝 핵심 논문을 초보자가 따라가기 쉽게 모은 사이트</li> <li>목록은 딥러닝, 컴퓨터 비전, 순차 모델링, 어텐션, 트랜스포머, 그래프 신경망, 스케일링 법칙, 정보이론, 복잡성 이론 등 현대 AI의 주요 발전 흐…
-
Kolmogorov-Arnold Networks를 이용한 FPGA 초고속 머신러닝
Ultrafast machine learning on FPGAs via Kolmogorov-Arnold Networks | Aarush Gupta
<p><a href="https://web.archive.org/web/20260609200156/https://aarushgupta.io/posts/kan-fpga/" rel="nofollow">https://web.archive.org/web/20260609200156/https://aarushgup...</a></p…
-
LLM이 인간 같은 속성을 가진다면 Age of Empires II도 그렇다
LLM이 인간 같은 속성을 가진다면 Age of Empires II도 그렇다 | GeekNews
<ul> <li>LLM 연구의 <strong>의인화 평가</strong>는 모델 출력에 인간 같은 속성을 부여하거나 가정할 때 측정 기준 없이 해석이 표현 방식에 좌우될 수 있다는 문제 제기</li> <li>Age of Empires II 안에 단순 신경망을 구현·훈련한 사례는 충분히 강력한 <strong>기질(subst…
-
그들은 가중치로 만들어졌다
그들은 가중치로 만들어졌다 | GeekNews
<ul> <li><strong>가중치</strong>는 AI 모델 안에 사전, 문법 규칙, 작은 사람, 언어 모듈, 추론 장치, 데이터베이스가 따로 없고 80개 층의 부동소수점 숫자 곱셈이 문장과 추론을 만든다는 풍자적 전제임</li> <li>성과 평가의 어조 완화와 추도문 작성도 기술적으로 <strong>다음 토큰 예측…
-
Gemma 4 12B: 통합형 인코더 없는 멀티모달 모델
Gemma 4 12B: 통합형 인코더 없는 멀티모달 모델 | GeekNews
<ul> <li><strong>Gemma 4 12B</strong>는 노트북에서 에이전트형 멀티모달 지능을 실행하도록 설계된 중간 크기 모델이며, edge 친화적인 E4B와 더 고급인 26B MoE 사이의 간극을 메움</li> <li><strong>인코더 없는 통합 아키텍처</strong>로 이미지와 오디오 입력을 별도 …
-
LLM의 실제 작동 원리
How LLMs Actually Work
<p>Article URL: <a href="https://www.0xkato.xyz/how-llms-actually-work/">https://www.0xkato.xyz/how-llms-actually-work/</a></p> <p>Comments URL: <a href="https://news.ycombinator.c…
-
자연어 오토인코더: Claude의 생각을 텍스트로 변환하기
Natural Language Autoencoders
-
봄날의 꿈: 2026년 1-2월 오픈웨이트 LLM 10가지 아키텍처
A Dream of Spring for Open-Weight LLMs: 10 Architectures from Jan-Feb 2026
A Round Up And Comparison of 10 Open-Weight LLM Releases in Spring 2026
-
LLM 추론을 위한 강화학습의 현황
The State of Reinforcement Learning for LLM Reasoning
Understanding GRPO and New Insights from Reasoning Model Papers