How to use from
llama.cpp
Install (macOS, Linux)
curl -LsSf https://llama.app/install.sh | sh
# Start a local OpenAI-compatible server with a web UI:
llama serve -hf tokimoa/jp-invoice-reader-2b-GGUF:
# Run inference directly in the terminal:
llama cli -hf tokimoa/jp-invoice-reader-2b-GGUF:
Install from WinGet (Windows)
winget install llama.cpp
# Start a local OpenAI-compatible server with a web UI:
llama serve -hf tokimoa/jp-invoice-reader-2b-GGUF:
# Run inference directly in the terminal:
llama cli -hf tokimoa/jp-invoice-reader-2b-GGUF:
Use pre-built binary
# Download pre-built binary from:
# https://github.com/ggerganov/llama.cpp/releases
# Start a local OpenAI-compatible server with a web UI:
./llama-server -hf tokimoa/jp-invoice-reader-2b-GGUF:
# Run inference directly in the terminal:
./llama-cli -hf tokimoa/jp-invoice-reader-2b-GGUF:
Build from source code
git clone https://github.com/ggerganov/llama.cpp.git
cd llama.cpp
cmake -B build
cmake --build build -j --target llama-server llama-cli
# Start a local OpenAI-compatible server with a web UI:
./build/bin/llama-server -hf tokimoa/jp-invoice-reader-2b-GGUF:
# Run inference directly in the terminal:
./build/bin/llama-cli -hf tokimoa/jp-invoice-reader-2b-GGUF:
Use Docker
docker model run hf.co/tokimoa/jp-invoice-reader-2b-GGUF:
Quick Links

jp-invoice-reader-2b-GGUF โ€” ๆ—ฅๆœฌ่ชžๅธณ็ฅจใƒชใƒผใƒ€ใƒผ

ๆ—ฅๆœฌ่ชžๅธณ็ฅจ๏ผˆ่ซ‹ๆฑ‚ๆ›ธใƒป่ฆ‹็ฉๆ›ธใƒป็ดๅ“ๆ›ธใƒป้ ˜ๅŽๆ›ธ๏ผ‰ใฎ่ชญใฟๅ–ใ‚Šใซ็‰นๅŒ–ใ—ใŸ jp-invoice-reader-2b ใฎGGUF็‰ˆใงใ™ใ€‚llama.cppใงWindows/LinuxใฎCPUใƒปGPUใงๅ‹•ใใพใ™ใ€‚

ใƒ•ใ‚กใ‚คใƒซ

ใƒ•ใ‚กใ‚คใƒซ ใ‚ตใ‚คใ‚บ ็”จ้€”
jp-invoice-reader-2b-Q8_0.gguf 1.7GB ๆŽจๅฅจ๏ผˆๆŠฝๅ‡บใƒปQAใจใ‚‚๏ผ‰
jp-invoice-reader-2b-Q4_K_M.gguf 1.0GB QA็”จ้€”ๅ‘ใ‘๏ผˆไธ‹่จ˜ๆณจๆ„๏ผ‰
jp-invoice-reader-2b-f16.gguf 3.2GB ๅ‚็…ง็”จ
mmproj-jp-invoice-reader-2b-f16.gguf 781MB ่ฆ–่ฆšใ‚จใƒณใ‚ณใƒผใƒ€๏ผˆๅฟ…้ ˆใƒปใฉใฎ้‡ๅญๅŒ–ใจใ‚‚็ต„ใฟๅˆใ‚ใ›ๅฏ๏ผ‰

ๅฎŸๆธฌ๏ผˆๅ…ฌ้–‹ไธญใฎbf16็‰ˆใจๅŒไธ€ใƒ—ใƒญใƒˆใ‚ณใƒซ: ๆœช่ฆ‹่ฉ•ไพก100ๆžšใƒปQA400ๅ•ใƒปๆŠฝๅ‡บ700ใƒ•ใ‚ฃใƒผใƒซใƒ‰๏ผ‰

ๆŒ‡ๆจ™ bf16๏ผˆMLXๅ…ฌ้–‹็‰ˆ๏ผ‰ Q8_0 Q4_K_M
ja-docs QA๏ผˆๅฎŸๅ†™้ขจ6ๅ•๏ผ‰ 6/6 6/6 6/6
ๅธณ็ฅจQA 93.5% 91.8% 90.5%
ๆŠฝๅ‡บใƒ•ใ‚ฃใƒผใƒซใƒ‰ไธ€่‡ด๏ผˆๅŽณๅฏ†๏ผ‰ 90.1% 84.3% 67.3%

ๅŽณๅฏ†ไธ€่‡ดใฎไฝŽไธ‹ใซใคใ„ใฆๅฎŸๆ…‹ใ‚’่ฃœ่ถณใ—ใพใ™๏ผˆๅŒไธ€100ๆžšใง่ฟฝๅŠ ๆคœ่จผ๏ผ‰:

  • Q8_0ใฎไฝŽไธ‹ๅˆ†ใฏใปใผๅฝขๅผใ‚†ใ‚Œใงใ™ใ€‚ ๆถˆ่ฒป็จŽ้กใ‚’{"rate": 10, "amount": 1449000}ใฎใ‚ˆใ†ใซใƒใ‚นใƒˆใง่ฟ”ใ™ๆบใ‚ŒใŒๅข—ใˆใ€ๅŽณๅฏ†ไธ€่‡ดใงใฏร—ใซใชใ‚Šใพใ™ใŒใ€็จŽ้กใฎๅ€คใƒ™ใƒผใ‚นใงใฏ99/100ใŒๆญฃ่งฃใงใ—ใŸใ€‚้‡‘้กใฎ่ชญใฟๅ–ใ‚Š่ƒฝๅŠ›่‡ชไฝ“ใฏ็ถญๆŒใ•ใ‚Œใฆใ„ใพใ™ใ€‚ๅพŒๆฎตใงJSONใ‚’ๅ—ใ‘ใ‚‹ใจใใฏใƒใ‚นใƒˆๅฝขๅผใ‚‚่จฑๅฎนใ—ใฆใใ ใ•ใ„ใ€‚
  • Q4_K_MใฏJSONๆง‹ๆ–‡ใฎๅดฉใ‚ŒใŒ100ๆžšไธญ15ไปถ็™บ็”Ÿใ—ใพใ™ใ€‚ ๆŠฝๅ‡บ๏ผˆ้•ทใ„ๆง‹้€ ๅŒ–ๅ‡บๅŠ›๏ผ‰ใซใฏ้žๆŽจๅฅจใงใ€QA็”จ้€”ๅ‘ใ‘ใงใ™ใ€‚

ไฝฟใ„ๆ–น

llama-server -m jp-invoice-reader-2b-Q8_0.gguf --mmproj mmproj-jp-invoice-reader-2b-f16.gguf \
  --port 8080 --jinja -c 8192 --image-min-tokens 64 --image-max-tokens 4096

้‹็”จไธŠใฎๆณจๆ„๏ผˆใ„ใšใ‚Œใ‚‚ๅฎŸๆธฌใซๅŸบใฅใ๏ผ‰:

  1. APIใงใฏ็”ปๅƒใ‚’ใƒ†ใ‚ญใ‚นใƒˆใ‚ˆใ‚Šๅ…ˆใซ็ฝฎใ„ใฆใใ ใ•ใ„๏ผˆcontentใฎไธฆใณใ‚’[image_url, text]ใซใ™ใ‚‹๏ผ‰ใ€‚้€†้ †ใฏ็ฒพๅบฆใŒไธ‹ใŒใ‚Šใพใ™ใ€‚
  2. -c 8192็ญ‰ใงใ‚ณใƒณใƒ†ใ‚ญใ‚นใƒˆ้•ทใ‚’ๆŒ‡ๅฎšใ—ใฆใใ ใ•ใ„ใ€‚ ็„กๆŒ‡ๅฎšใฏใƒขใƒ‡ใƒซๅฎฃ่จ€ใฎ262Kใง็ขบไฟใ—ใ‚ˆใ†ใจใ—ใฆใƒกใƒขใƒชไธ่ถณใซใชใ‚Šใพใ™ใ€‚
  3. --image-max-tokens 4096ใ‚’ๆŽจๅฅจใ—ใพใ™ใ€‚ ๅธณ็ฅจใฏ้ซ˜่งฃๅƒๅบฆใฎใŸใ‚ใ€ๆ—ขๅฎšใงใฏ็”ปๅƒใŒ้Žๅ‰ฐใซ็ธฎๅฐใ•ใ‚Œๆ•ฐๅ€คใฎ่ชญใฟๅ–ใ‚ŠใŒ่ฝใกใพใ™ใ€‚

ใƒ—ใƒญใƒณใƒ—ใƒˆไพ‹: ๆŠฝๅ‡บใฏใ€Œใ“ใฎๅธณ็ฅจใ‹ใ‚‰ไธป่ฆ้ …็›ฎใ‚’ๆŠฝๅ‡บใ—ใฆJSONใงๅ‡บๅŠ›ใ—ใฆใใ ใ•ใ„ใ€‚ใ€ใ€QAใฏใ€Œใ“ใฎ่ซ‹ๆฑ‚ๆ›ธใฎๅˆ่จˆ้‡‘้กใฏ๏ผŸใ€็ญ‰ใฎ่‡ช็”ฑ่ณชๅ•ใงใ™ใ€‚

ๅˆถ็ด„

ๅˆๆˆๅธณ็ฅจใƒ‰ใƒกใ‚คใƒณใงๅญฆ็ฟ’ใ—ใฆใ„ใพใ™ใ€‚ๅฎŸๅ†™ใ‚นใ‚ญใƒฃใƒณใƒปๆ‰‹ๆ›ธใใƒป็‰นๆฎŠใƒฌใ‚คใ‚ขใ‚ฆใƒˆใฏๆœชๆคœ่จผใงใ€ๅ†™็œŸ็”ฑๆฅใฎๅธณ็ฅจใงใฏ็ฒพๅบฆใŒไธ‹ใŒใ‚‹ๅฏ่ƒฝๆ€งใŒใ‚ใ‚Šใพใ™ใ€‚

ใƒฉใ‚คใ‚ปใƒณใ‚นใจๅธฐๅฑž

  • ใƒ™ใƒผใ‚น: Qwen/Qwen3-VL-2B-Instruct๏ผˆApache-2.0๏ผ‰
  • ๅญฆ็ฟ’ใƒ‡ใƒผใ‚ฟใƒป่ฉ•ไพกๆ–นๆณ•ใฎ่ฉณ็ดฐใฏๆœฌไฝ“repoใ‚’ๅ‚็…งใ—ใฆใใ ใ•ใ„

Developed by tokimoa โ€” ใƒ‡ใƒผใ‚ฟใ‚’ๅค–ใซๅ‡บใ•ใชใ„AIๆดป็”จใ‚’ๆ”ฏๆดใ—ใฆใ„ใพใ™

Downloads last month
94
GGUF
Model size
2B params
Architecture
qwen3vl
Hardware compatibility
Log In to add your hardware

4-bit

8-bit

16-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. ๐Ÿ™‹ Ask for provider support

Model tree for tokimoa/jp-invoice-reader-2b-GGUF

Quantized
(86)
this model