-
GitHub - marcelroed/gigatoken: GB/s 속도의 언어 모델 토큰화
GitHub - marcelroed/gigatoken: Language model tokenization at GB/s
<p>Article URL: <a href="https://github.com/marcelroed/gigatoken/">https://github.com/marcelroed/gigatoken/</a></p> <p>Comments URL: <a href="https://news.ycombinator.com/item?id=4…
-
Nativ - 프런티어급 오픈 모델을 Mac에서 로컬 실행
Nativ - 프런티어급 오픈 모델을 Mac에서 로컬 실행 | GeekNews
<ul> <li><strong>Nativ</strong>은 Apple Silicon Mac에서 오픈 AI 모델을 내려받아 계정·구독·클라우드 없이 실행하는 MIT 라이선스 오픈소스 앱임</li> <li>Google, Cohere, Liquid AI 등의 모델을 제공하며, Mac 하드웨어에 적합한 모델을 추천하고 모든 응답…
-
Claude가 load-bearing을 반복하는 것을 멈추는 방법
How to stop Claude from saying load-bearing | jola.dev
<p>Article URL: <a href="https://jola.dev/posts/how-to-stop-claude-from-saying-load-bearing">https://jola.dev/posts/how-to-stop-claude-from-saying-load-bearing</a></p> <p>Comments …
-
새로운 GPT-5.6 패밀리: Luna, Terra, Sol
The new GPT-5.6 family: Luna, Terra, Sol
<p>OpenAI's latest flagship model <a href="https://openai.com/index/gpt-5-6/">hit general availability this morning</a>, and comes in three sizes: Luna, Terra, and Sol (from smalle…
-
OpenAI GPT 5.6이 출시되었습니다.
OpenAI GPT 5.6이 출시되었습니다. | GeekNews
<p>OpenAI가 2026년 7월 9일, GPT-5.6 패밀리를 정식 출시(GA)했습니다. 6월 26일 프리뷰 이후의 정식 공개이며, <strong>Sol</strong>(플래그십), <strong>Terra</strong>(균형형), <strong>Luna</strong>(최저비용) 세 개의 티어로 구성됩니다.</p>…
-
Leanstral 1.5: 모두를 위한 증명
Leanstral 1.5: Proof abundance for all
<p>Article URL: <a href="https://mistral.ai/news/leanstral-1-5/">https://mistral.ai/news/leanstral-1-5/</a></p> <p>Comments URL: <a href="https://news.ycombinator.com/item?id=48780…
-
로컬 LLM 실행에 관한 모든 것
GitHub - jamesob/local-llm: Everything I know about running LLMs locally
<p>Article URL: <a href="https://github.com/jamesob/local-llm">https://github.com/jamesob/local-llm</a></p> <p>Comments URL: <a href="https://news.ycombinator.com/item?id=48775921"…
-
Qwen 3.6 27B는 로컬 개발의 최적 지점
Qwen 3.6 27B는 로컬 개발의 최적 지점 | GeekNews
<ul> <li><strong>Qwen 3.6 27B</strong>는 로컬 모델에 회의적이던 사용자에게도 범용 작업에서 의미 있는 선택지로 보이며, 35B A3B보다 느리지만 더 강력한 dense 모델로 추천됨</li> <li>창작·코딩 테스트에서는 <strong>제약 조건 준수</strong>가 강점으로 드러났고, O…
-
DSpark: 추측적 디코딩을 통한 LLM 추론 가속
DSpark: Speculative decoding accelerates LLM inference [pdf]
<p>Article URL: <a href="https://github.com/deepseek-ai/DeepSpec/blob/main/DSpark_paper.pdf">https://github.com/deepseek-ai/DeepSpec/blob/main/DSpark_paper.pdf</a></p> <p>Comments …
-
GPT-5.5가 MIT 라이선스 GLM-5.2보다 3배 더 환각함
GPT-5.5 hallucinates 3x more than MIT-licensed GLM-5.2
<p>Article URL: <a href="https://arrowtsx.dev/bigger-models/">https://arrowtsx.dev/bigger-models/</a></p> <p>Comments URL: <a href="https://news.ycombinator.com/item?id=48600167">h…
-
GPT-NL: 네덜란드의 주권 언어 모델
GPT‑NL: a sovereign language model for the Netherlands
<p>Article URL: <a href="https://www.tno.nl/en/digital/artificial-intelligence/gpt-nl/">https://www.tno.nl/en/digital/artificial-intelligence/gpt-nl/</a></p> <p>Comments URL: <a hr…
-
그들은 가중치로 만들어졌다
그들은 가중치로 만들어졌다 | GeekNews
<ul> <li><strong>가중치</strong>는 AI 모델 안에 사전, 문법 규칙, 작은 사람, 언어 모듈, 추론 장치, 데이터베이스가 따로 없고 80개 층의 부동소수점 숫자 곱셈이 문장과 추론을 만든다는 풍자적 전제임</li> <li>성과 평가의 어조 완화와 추도문 작성도 기술적으로 <strong>다음 토큰 예측…
-
Gemma 4 12B: 통합형 인코더 없는 멀티모달 모델
Gemma 4 12B: 통합형 인코더 없는 멀티모달 모델 | GeekNews
<ul> <li><strong>Gemma 4 12B</strong>는 노트북에서 에이전트형 멀티모달 지능을 실행하도록 설계된 중간 크기 모델이며, edge 친화적인 E4B와 더 고급인 26B MoE 사이의 간극을 메움</li> <li><strong>인코더 없는 통합 아키텍처</strong>로 이미지와 오디오 입력을 별도 …