Apple M4 Neural Engine ve WebGPU WGSL ile Tarayıcı İçi 1.58-Bit Ağırlık Çıkarımı
WebGPU WGSL matris çekirdekleri üzerinde koşan ternar {-1, 0, +1} ağırlık matrisleri, sunucu maliyetini sıfıra indirerek yapay zeka çıkarımını doğrudan yerel donanıma teslim ediyor.