-
Databricks가 자체 코딩 AI 벤치마크를 만든 방법과 결과
Databricks가 자체 코딩 AI 벤치마크를 만든 방법과 결과 | GeekNews
<ul> <li>공개된 코딩 벤치마크는 회사별 상황에 딱 맞지 않고 치팅이 가능한 것이 문제 <ul> <li>Databricks에서 실제 수행한 과제, 언어로 벤치마크를 만들어 평가</li> </ul> </li> <li>GLM 5.2는 가장 어려운 과제도 Opus 4.8과 같은 수준으로 해결했지만 가격은 Opus의 66%…
-
Ask HN: 일상적인 코딩에서 Claude/GPT를 로컬 모델로 대체한 사람이 있나요?
Ask HN: 일상적인 코딩에서 Claude/GPT를 로컬 모델로 대체한 사람이 있나요? | GeekNews
<ul> <li><strong>데이터 프라이버시</strong>와 LLM의 무료 사용을 이유로 클라우드 모델을 완전히 떠난 개발자들이 등장 중이며, 컨테이너화·샌드박스화된 <strong>오프라인 코딩 하니스</strong>로 외부 네트워크 호출 없이 작업 가능</li> <li>주력 모델은 <strong>Qwen3.6 35…