Show HN: Open-source engine running Gemma 4 26B in 2 GB RAM on any M-series Mac
By gitpusher42 · Discussion · HN
Hi HN,I built a specialized inference engine for running 4-bit Gemma 4 26B-A4B-IT on any M-series Mac using about 2 GB of RAM. It is called TurboFieldfare and is written in Swift and Metal.I have always adored on-device AI. It feels like magic that you can run a powerful NN on yo