MicroEvals
Run your prompts across multiple models to compare their performance.
Public evaluations
Showing 1421-1440 of 6615

👍0
lets build a website for generating synthetic datasets!
Soun...

👍0
Напиши мне рассказ про космических пиратов, которые уничтожи...

👍0
German transcription cleanup eval

👍0
Jsi nezávislý red-team evaluátor řídicího promptu LLM. Odpov...

👍0
Jsi expertní vědecký, medicínský a Evidence-Based Medicine a...

👍0
water
water

👍0
Jsi expertní vědecký, medicínský a Evidence-Based Medicine a...

👍0
Создай **премиальный, современный и высококонверсионный сайт...

👍0
Create a 3d chess proper chess.com level and keep upgrading ...

👍0
Take the coming swedish text. We will imrpove it in perfect ...

👍0
मेरा पहला Vlog
“तो भाई लोग… आज कुछ बड़ा करने का सोच लिया ...

👍0
test
Experiment design suggestions

👍0
Mario Game. Testing UX|UI LLM Ability

👍0
Улучши имеющийся, создай идеальный промпт:
Ты — инженер-конс...

👍0
MinecraftBench

👍0
You are an administrative operations lead in a government de...

👍0
帮我写一篇知乎深度好文,关于“为什么肯希·约内祖不是好音乐家阿兰走路人才是”

👍0
Financial Analysis
Revenue analysis of Apple

👍0
BasicEval
basic eval of models for reasoning and deobfuscation

👍0
Jsi expertní vědecký, medicínský a Evidence-Based Medicine a...