Gemma4破限版的安装
谷歌推出了Gemma4,那有好事者船载以入,直接破了它的道德感,可以逆向,破解,我们来试试吧 运行环境: Ubuntu 22.04,Nvidia 3060 8G显卡 # 首先下载模型 uv pip install -U "huggingface_hub" uv tool run hf auth login --token hf_xxxxxxxx # 破限模型的地址:https://huggingface.co/HauhauCS/Gemma-4-E4B-Uncensored-HauhauCS-Aggressive # 本来应该运行Q5_K_M 或者Q5_K_P,但是还要跑多模态,降一档 # 跑Q4_K_P 或者Q4_K_M加上多模态文件 # 下载Q4_KM uv tool run hf download HauhauCS/Gemma-4-E4B-Uncensored-HauhauCS-Aggressive Gemma-4-E4B-Uncensored-HauhauCS-Aggressive-Q4_K_M.gguf /home/ubuntu/.cache/huggingface/hub/models--HauhauCS--Gemma-4-E4B-Uncensored-HauhauCS-Aggressive/snapshots/45b6a334b4bcd1d7f37179df58b3b1d66a184e5d/Gemma-4-E4B-Uncensored-HauhauCS-Aggressive-Q4_K_M.gguf # 下载多模态文件 uv tool run hf download HauhauCS/Gemma-4-E4B-Uncensored-HauhauCS-Aggressive mmproj-Gemma-4-E4B-Uncensored-HauhauCS-Aggressive-f16.gguf /home/ubuntu/.cache/huggingface/hub/models--HauhauCS--Gemma-4-E4B-Uncensored-HauhauCS-Aggressive/snapshots/45b6a334b4bcd1d7f37179df58b3b1d66a184e5d/mmproj-Gemma-4-E4B-Uncensored-HauhauCS-Aggressive-f16.gguf 然后需要编译llama.app,否则认不出gemma4这个最新的模型: apt install nvidia-driver-590 apt install nvidia-cuda-toolkit apt install gcc-10 g++-10 git clone https://github.com/ggerganov/llama.cpp cd llama.app # apt 安装的590其实版本比较旧,但是ubuntu 22.04自带的gcc11版本高了,导致cuda的编译认不出来高版本的文件 # 所以必须用低版本的gcc来编译旧版本的cuda驱动 cmake -S . -B build -DCMAKE_BUILD_TYPE=Release \ -DGGML_CUDA=ON -DCMAKE_CUDA_ARCHITECTURES=86 \ -DCMAKE_CUDA_HOST_COMPILER=/usr/bin/gcc-10 cmake --build build --config Release -j 8 cd build/bin 编译好后运行测试一下: ...