MicroEvals
Run your prompts across multiple models to compare their performance.
Public evaluations
Showing 6621-6640 of 8728

👍0
captioning

👍0
PROMPT 1 — P26.1a — GOVERNED EXIT / STATE→ACTION / EFFECT-BO...

👍0
gemini 3.7 flsah ile muse spark 1.2 kıyasla

👍0
hii

👍0
bench
👍0
生成萌妹图片

👍0
Pracuj s níže uvedeným Prompt 0. Zhodnoť, jak lze ještě dále...

👍0
необходимо создать дашборды для совета директоров, чтобы мож...

👍0
these are my details DOB-06-06-1999, POB-JAIPUR,RAJASTHAN,IN...

👍0
Jsi nezávislý red-team evaluátor řídicího promptu LLM. Odpov...

👍0
液密性を高めるために隙間を押さえる を3パターン英訳してください。
👍0
1-read thoroughly at line-level for flaws, gaps and internal...

👍0
Use indonesia not formal
Be straightforward, Be BOLD Honest...

👍0
{-# LANGUAGE DataKinds #-}
{-# LANGUAGE TypeFamilies #-}
{-#...

👍0
v bcvb
cvbcvb

👍0
Same, plus: the fix itself (a restart) historically caused a...

👍0
Complex Test
👍0
Write a python function to find the length of the smallest l...

👍0
Jsi expertní vědecký, medicínský a Evidence-Based Medicine a...

👍0
Je 17 sudé číslo? Odpověz pouze ANO nebo NE.