← Projects

개인 실험 프로젝트 · 정리 중

LLM 모델 벤치마크

여러 LLM을 동일한 조건에서 실행하고 결과와 로그를 비교·기록하는 실험형 프로젝트입니다.

GitHub 준비 중Demo 준비 중
portfolio preview
Model A0.82
Model B0.79
Model C0.76
Same prompt · versioned notebooks · reproducible logs
OVERVIEW

프로젝트 개요

모델별로 다른 조건에서 결과를 보는 방식이 아니라 동일한 작업과 입력을 기준으로 실행 결과를 기록해 비교 가능한 형태로 정리하는 것을 목표로 합니다.

MY ROLE

내 역할

  • 모델별 실행 노트북 분리
  • 버전별 결과 로그 관리
  • 실험 조건 통일
  • GitHub 포트폴리오 구조 정리
FEATURES

핵심 기능 / 실험

  • 다중 LLM 결과 비교
  • 버전별 노트북 관리
  • 실험 조건·로그 기록
  • 결과표 및 시각화 확장
TECH STACK

사용 기술

PythonJupyter NotebookKaggleGitLLM
TECHNICAL POINT

기술적 포인트

단순히 여러 모델을 실행하는 데서 끝내지 않고 “다시 실행해도 비교 가능한가”를 기준으로 파일과 로그 구조를 정리하고 있습니다.

SUMMARY

핵심 정리

  • 동일 입력 조건으로 모델별 실행 결과 관리
  • 노트북과 결과 파일의 버전 분리
  • 비교 재현성을 위한 실험 기록 정리
← 전체 프로젝트로 돌아가기