Benchmarks und mehr: Coding, General & Vision
Tja... wer rastet, der rostet. Und wer nur Code-Snippets benchmarkt, der übersieht die halbe Miete. Bisher haben wir uns in der LLMGui Benchmark Suite ja hauptsächlich darauf konzentriert, wie schnell die Modelle Python-Funktionen hinklatschen können. Aber hey... wir nutzen diese digitalen Gehirne ...