그냥 귀찮아서 가장 최신 받아서
claude 에서 빌드해달라고 하고 해버림
여전히 -sm row, -sm tensor 는 안되는데 머가 문제이려나?
cuda로 해서 그런가.. 아니면 가장 최신버전 이라서 성능향상이 생긴건가?
| commit 930e2fa5995789efbf249a8bf61325bb626e417b (HEAD -> master, tag: b10991, origin/master, origin/HEAD) Author: Jhen-Jie Hong <iainst0409@gmail.com> Date: Wed Sep 16 07:02:06 2026 +0800 hexagon: add back missing contiguous fast-path and hvx_copy_uu for each run (#28886) |
11 정도였던것 같은데 약간 상승한듯?
| /mnt/Downloads/llama.cpp/build/bin$ ./llama-cli -m /mnt/Downloads/model/gemma4-31b/gemma-4-31B-it-UD-Q2_K_XL.gguf -sm layer > 안녕? [ Prompt: 35.4 t/s | Generation: 14.3 t/s ] > 너에 대해 설명해줘 [ Prompt: 63.5 t/s | Generation: 13.9 t/s ] > 파이썬으로 셀레니움을 통해 웹을 서칭하고 텍스트만 추출하고 makrdown 으로 변환후 md 파일과 pdf로 저장하는 기능을 구현해줘 [ Prompt: 162.4 t/s | Generation: 13.3 t/s ] |
pcie3.0 은 별 차이 없었으니 일단 이전 기록 끌어오면 2token/s 정도씩 상승한듯?
| $ ../../llama-b9692/llama-cli -m ./gemma-4-31B-it-UD-Q2_K_XL.gguf 안녕? [ Prompt: 8.9 t/s | Generation: 12.2 t/s ] 너에 대해 설명해줘 [ Prompt: 33.3 t/s | Generation: 11.8 t/s ] 파이썬으로 셀레니움을 통해 웹을 서칭하고 텍스트만 추출하고 makrdown 으로 변환후 md 파일과 pdf로 저장하는 기능을 구현해줘 [ Prompt: 36.1 t/s | Generation: 11.4 t/s ] |
2026.07.30 - [모종의 음모/ai 프로그램] - llama.cpp / 1080 ti 11GB * 2/ gemma4-31B
+
클로드가 왜 row 안되는지 보고 있는데 split buffer 모드가 멀까?
| ● -sm row이 실패하는 원인을 정확히 잡았습니다: GTX 1080 Ti가 CUDA의 "split buffer"를 지원하지 않는다는 에러입니다. 소스에서 어떤 조건인지 확인하겠습니다. |
구글 검색 ai 답변
volta 사라고 등 떠미는 느낌이지 왜? ㅠㅠ
|
'모종의 음모 > ai 프로그램' 카테고리의 다른 글
| LLM / 1080 ti 모드 별 벤치마크 (0) | 2026.09.17 |
|---|---|
| v100 흐음... (0) | 2026.09.16 |
| 1080 ti / pcie3.0 설정후 재 테스트 (0) | 2026.09.15 |
| auroc - area under the ROC curve (0) | 2026.09.01 |
| llama.cpp vulkan / intel uhd 630 (0) | 2026.09.01 |
