-
AI 연구소들은 '자전거 타는 펠리컨'에 맞춰 모델을 최적화했을까?
AI 연구소들은 ‘자전거 타는 펠리컨’에 맞춰 모델을 최적화했을까? | GeekNews
<ul> <li>7개 프런티어 모델에서 1,008개 SVG를 비교한 결과, 유명 프롬프트에 맞춰 성능을 끌어올리는 <strong>pelicanmaxxing</strong>의 뚜렷한 증거는 발견되지 않음</li> <li>8종의 동물과 6종의 탈것을 조합한 48개 프롬프트를 모델마다 3회 실행하고, <strong>GPT-5.…
-
GPU 없이 13년 된 Xeon에서 Gemma 4 26B를 초당 5토큰으로 실행하기
GPU 없이 13년 된 Xeon에서 Gemma 4 26B를 초당 5토큰으로 실행하기 | GeekNews
<ul> <li>2013년형 듀얼 Xeon E5-2690 v2와 DDR3로 구성된 서버에서 <strong>Gemma 4 26B-A4B Q8_0</strong>을 CPU만으로 구동해 디코딩 약 5.2토큰/초, 프롬프트 평가 약 16토큰/초를 달성함</li> <li><code>ik_llama.cpp</code>의 고속 경로는…
-
Qwen 3.6 27B: 로컬 개발의 최적 모델
Qwen 3.6 27B is the sweet spot for local development - Quesma Blog
<p>Article URL: <a href="https://quesma.com/blog/qwen-36-is-awesome/">https://quesma.com/blog/qwen-36-is-awesome/</a></p> <p>Comments URL: <a href="https://news.ycombinator.com/ite…
-
MiMo-v2.5-Pro-UltraSpeed: 초당 1000 토큰을 처리하는 1T 모델
MiMo-v2.5-Pro-UltraSpeed: 1T model with 1000 tokens per second
<p>Article URL: <a href="https://mimo.xiaomi.com/blog/mimo-tilert-1000tps">https://mimo.xiaomi.com/blog/mimo-tilert-1000tps</a></p> <p>Comments URL: <a href="https://news.ycombinat…