MicroEvals
Run your prompts across multiple models to compare their performance.
Public evaluations
Showing 1341-1360 of 8439

👍0
kimsin sen

👍0
Nick
👍0
QH VisionX — AI Web Development Benchmark
مقایسه توانایی مدلهای هوش مصنوعی در تولید وبسایتهای حرفهای با HTML, CSS و JavaScript.

👍0
Matka
Matka

👍0
Write complete, highly optimized pure JavaScript code (for a...

👍0
Read it letter by letter line by line from beginning to end—...

👍0
B.M.12 — METHODOLOGY v27 VALIDATION: CZECH FILE ALIASES / CO...

👍0
STM32F407的中断延迟多长时间

👍0
The twelve letters $A,B,C,D,E,F,G,H,I,J,K$, and $L$ are rand...

👍0
Test

👍0
Jsi nezávislý red-team evaluátor řídicího promptu LLM. Odpov...
👍0
Penguin commander SVG
Generate an SVG of a penguin commanding in an epic space battle.

👍0
Make flappy bird as a workout game using your camera

👍0
test1
testing instruction following
👍0
P44.1 — HUMAN-CENTERED / BIOMEDICAL USE-ERROR / FIELD-TESTIN...
👍0
"""Build a local JSON index from a PDF localy
Run from this...

👍0
hello

👍0
neurotransmitter

👍0
# B.M.7 — FULL AUTONOMOUS METHODOLOGY VALIDATION OF v22
## ...
👍0
P45.1 — HUMAN-USE OPERATIONAL GATE / TRANSFER / RETENTION CH...