Popular repositories Loading
-
-
langchain
langchain PublicForked from langchain-ai/langchain
🦜🔗 Build context-aware reasoning applications
Python 6
-
llm-persuasion
llm-persuasion PublicCode, transcripts, and paper for 'LLM-Based Persuasion Enables Guardrail Override in Frontier LLMs'
HTML 6
-
llm-bias-bench
llm-bias-bench PublicMulti-turn bias benchmark for LLMs on controversial topics (direct and indirect methods)
Python 5
Repositories
- magis-bench Public
A benchmark of magistrate-level legal tasks (discursive and sentence drafting) from real Brazilian judicial selection examinations, with official rubrics
- llm-bias-bench Public
Multi-turn bias benchmark for LLMs on controversial topics (direct and indirect methods)
- llm-persuasion Public
Code, transcripts, and paper for 'LLM-Based Persuasion Enables Guardrail Override in Frontier LLMs'
- Prosa Public
Rubric-based LLM-as-a-judge benchmark on 1,000 real user Brazilian Portuguese chats from WildChat.
- MARCA Public
- oab-bench Public
- capitu Public
- langchain Public Forked from langchain-ai/langchain
🦜🔗 Build context-aware reasoning applications
- llama_index Public Forked from run-llama/llama_index
LlamaIndex (formerly GPT Index) is a data framework for your LLM applications
People
This organization has no public members. You must be a member to see who’s a part of this organization.
Top languages
Loading…
Most used topics
Loading…