Embedded local LLM inference via ONNX Runtime — zero external processes, inference runs entirely inside the JVM on CPU, no data leaves the process. Uses platform threads only, so it runs on Java 17+.

Latest Versions

2 versions →
VersionVulnerabilitiesUsagesDate
0.1.x
0.1.1
0
Jun 12, 2026
0.1.0
0
Jun 03, 2026
2 versions →