Embedded local LLM inference via ONNX Runtime — zero external processes, inference runs entirely inside the JVM on CPU, no data leaves the process. Uses platform threads only, so it runs on Java 17+.
VersionVulnerabilitiesRepositoryUsagesDate
0.1.x
0.1.1Central
0
Jun 12, 2026
0.1.0Central
0
Jun 03, 2026