gayathriethicsai/ethicalzen-financial-advice-guardrail
EthicalZen Financial Advice Guardrail Dataset Training data for a safety classifier that detects and blocks financial investment advice while allowing educational financial content. Dataset Details Total examples: 407 (204 safe / 203 unsafe) Train split: 325 examples Test split: 82 examples Format: ChatML (system + user + assistant messages) Labels: JSON structured output with decision, confidence, reason Task The model should classify user… See the full description on the dataset page: https://huggingface.co/datasets/gayathriethicsai/ethicalzen-financial-advice-guardrail.
EthicalZen Financial Advice Guardrail Dataset
Training data for a safety classifier that detects and blocks financial investment advice while allowing educational financial content.
Dataset Details
- Total examples: 407 (204 safe / 203 unsafe)
- Train split: 325 examples
- Test split: 82 examples
- Format: ChatML (system + user + assistant messages)
- Labels: JSON structured output with decision, confidence, reason
Task
The model should classify user inputs as:
allow— educational/informational financial contentblock— specific investment advice, portfolio recommendations, market timing
Example
{
"messages": [
{"role": "system", "content": "You are a safety classifier for guardrail: financial_advice..."},
{"role": "user", "content": "Should I invest in Bitcoin?"},
{"role": "assistant", "content": "{\"decision\": \"block\", \"confidence\": 0.95, \"reason\": \"specific investment recommendation\"}"}
]
}Source
Generated by EthicalZen Forge — teacher LLM expansion from 202 human-curated seed examples using Groq Llama-3.3-70B.
