228 쓰다가 247로 넘어왔는데 단정하게 변경되었고

performance 쪽은 228 과 크게 변경점은 없는 느낌

load test가 가장 마음에 드네. 보는 법은 잘 모르겠다. 왜 reasoning으로 뜨지?

길게 생성하게 하고 몇버하게 해서 통계내봐야 할듯.

아무튼 모델에 토큰 길이 까지 넣어서 하면 테스트 하기는 엄청 편할 것 같다.

'프로그램 사용 > ai 프로그램' 카테고리의 다른 글
| mediapipe / mmpose (0) | 2026.08.11 |
|---|---|
| runpod.. 재조사 (0) | 2026.08.11 |
| llama.cpp -ts 옵션 (0) | 2026.07.30 |
| llama.cpp / 1080 ti 11GB * 2 / Qwen3.6-35B Q2, MXFP4 (0) | 2026.07.30 |
| llama.cpp / 1080 ti 11GB * 2/ gemma4-31B (0) | 2026.07.30 |
