뉴스
- 정부, 독파모 2차 평가 돌입…"데이터·비용·활용성 검증 관건" 평가 참여자의 연령과 직업, AI 이용 경험을 고르게 구성하고 모델별로 동일한 질문과 응답 시간, 사용 환경을 적용해야 평가 결과의 대표성과 신뢰성을 확보할 수 있다는 설명이다.사실 한 AI 업계 관계자는 "평가 참여자 연령과 직업, AI 이용 경험을 고르게 구성하고 모델별로 동일한 질문과 응답 시간, 사용 환경을 적용해야 평가 결과 대표성과 신뢰성을 확보할 수
- [안광섭 AI 진테제] 독파모 2차평가 눈앞...무엇을 '평가' 해야 하나 88.7점• GLM-5.1의 KMMLU-Pro: SK텔레콤 76.5점, LG 75.8점• 큐원3.5의 KMMLU-Pro: SK텔레콤 78.4점, LG 77.4점전부 1점 안에서 수렴한다 LG 리포트는 이 칸에 개발사 공식 발표치 31.0점을 인용해 넣었다.
- [현장] 배경훈 "국민 누구나 AI 잘 활용하도록"…모두의 AI 성장사다리 출범 생성형 AI 기반 추천 기능을 통해 이용자의 연령과 직업, 관심사에 맞는 교육 과정도 제안한다.' 개발 과정 등이 시연됐다.실험실에선 이용자가 플랫폼에 자연어로 요구사항을 입력하면 AI가 프롬프트를 설계하고 서비스를 구현하는 과정을 직접 확인할 수 있다.특히 개발 온보딩 단계에 LG