microsoft/promptbench
A unified evaluation framework for large language models
Language:Python
Total stars: 857
Stars trend:
#python
#adversarialattacks, #benchmark, #chatgpt, #evaluation, #largelanguagemodels, #prompt, #promptengineering, #robustness
A unified evaluation framework for large language models
Language:Python
Total stars: 857
Stars trend:
25 Dec 2023
7pm ██▍ +19
8pm █▏ +9
9pm █▍ +11
10pm █▌ +12
11pm █▍ +11
26 Dec 2023
12am █▌ +12
1am ██▌ +20
2am █▉ +15
3am █▌ +12
4am ▉ +7
5am █▎ +10
6am ██ +16#python
#adversarialattacks, #benchmark, #chatgpt, #evaluation, #largelanguagemodels, #prompt, #promptengineering, #robustness
wuyoscar/ISC-Bench
ISC-Bench: Internal Safety Collapse in Frontier LLMs | JailbreakArena | 56 TVD templates | AI Safety Benchmark | Agent Safety | Red Teaming | Jailbreak
Language:Python
Total stars: 278
Stars trend:
#python
#adversarialattacks, #agentsafety, #aisafety, #benchmark, #frontiermodels, #jailbreak, #largelanguagemodels, #llmsafety, #redteaming, #safetyevaluation
ISC-Bench: Internal Safety Collapse in Frontier LLMs | JailbreakArena | 56 TVD templates | AI Safety Benchmark | Agent Safety | Red Teaming | Jailbreak
Language:Python
Total stars: 278
Stars trend:
25 Mar 2026
11pm ▎ +2
26 Mar 2026
12am ▍ +3
1am ▎ +2
2am ▎ +2
3am ▊ +6
4am +0
5am ▍ +3
6am ▍ +3
7am ▍ +3
8am +0
9am ▎ +2
10am ▏ +1#python
#adversarialattacks, #agentsafety, #aisafety, #benchmark, #frontiermodels, #jailbreak, #largelanguagemodels, #llmsafety, #redteaming, #safetyevaluation