블로그
-
AI Benchmark와 평가 오염 한 조각: AI의 시험 점수는 정말 실력을 말해줄까?
지난 글에서는 학습 데이터를 선택하고 정제하는 데이터 큐레이션과, AI가 새로운 학습 자료를 만드는 합성 데이터를 살펴보았다. MMLU 점수가 몇 점인지, HumanEval에서 코드를 몇 개 통과했는지, GSM8K 수학 문제를 얼마나 맞혔는지가 모델 소개 자료에 등장한다. 서로 다른 모.......
blog.naver.com · 2026.08.04
-
[ML] Qwen2.5 Technical Report (PR-289)
improved to Qwen2: 1️⃣ 기존 LLM을 사용하여 데이터 품질을 필터링, 분류 및 점수화하여 사전 학습 데이터를 7T 토큰에서 18T 토큰으로 확장했습니다. 2️⃣ 수학 , 코드, 지식 영역과 관련된 합성 데이터를 생성했습니다. 3️⃣ 긴 텍스트, 수학, 코딩 및 다국어 작업을 포함하는 1백만 개 이상의 샘플로 SFT를 확장했습니다. 4️⃣ 다국어
blog.naver.com · 2024.12.21
-
[ML] Qwen2.5 Technical Report (PR-289)
improved to Qwen2: 1️⃣ 기존 LLM을 사용하여 데이터 품질을 필터링, 분류 및 점수화하여 사전 학습 데이터를 7T 토큰에서 18T 토큰으로 확장했습니다. 2️⃣ 수학 , 코드, 지식 영역과 관련된 합성 데이터를 생성했습니다. 3️⃣ 긴 텍스트, 수학, 코딩 및 다국어 작업을 포함하는 1백만 개 이상의 샘플로 SFT를 확장했습니다. 4️⃣ 다국어
blog.naver.com · 2024.12.21
-
PIECE - 공식 동아리
PIECE의 의미에 따라 모든 동아리 부원들이 적극적으로 활동에 참여할 수 있는 동아리입니다. 2.2021년 PIECE의 실험 계획 1.형상 기억 합금 실험 2.손에 불 붙이기 3.나일론 합성 실험 4.용액에 약 녹이기 실험 5.에어로졸 관찰 6.에어로젤 탐구 -수학/과학의 날은 PIECE의 개성있는 실험 부스를 운영할 예정입니다.
blog.naver.com · 2021.03.04