apps
Interactive AI products backed by a repository. CoolFace lists them; the app itself runs at the source.
OpenAssistant-reward-model-deberta-v3-large-v2OpenAssistant-reward-model-deberta-v3-large-v2OpenAssistant-reward-model-deberta-v3-large-v2reward-modeling-chat-uiOpenAssistant-reward-model-deberta-v3-large-v2train_a_reward_model_for_rlhfshahrukhx01-deberta-xsmall-hatespeech-reward-modelChaiML-reward_models_100_170000000_cp_498032Reward_Modelreward_modelOpenAssistant-reward-model-deberta-v3-large-v2reward-model-from-scratchrepro-model-free-robust-average-reward-rl-gmihhrj6wprepro-on-the-power-of-approximate-reward-models-for-inference-time-scaling-sequential-monte-carlrepro-model-free-robust-average-reward-reinforcement-learning-with-sample-complexity-analysisrepro-model-free-robust-average-reward-reinforcement-learning-with-sample-complexity-analysirepro-reward-models-itsrepro-model-free-robust-average-reward-reinforcement-learning-with-sample-complexity-analysisrepro-camel-confidence-gated-reflection-for-reward-modelingrepro-approximate-reward-models-for-inference-time-scaling-smc-and-beyondrepro-model-free-robust-average-reward-reinforcement-learning-with-sample-complexity-analysisrepro-on-the-power-of-approximate-reward-models-for-inference-time-scaling-sequential-monte-carlmodel-free-robust-average-reward-rl-reprorepro-on-the-power-of-approximate-reward-models-for-inference-time-scaling-sequential-monte-carlrepro-model-free-robust-average-reward-reinforcement-learning-with-sample-complexity-analysisrepro-on-the-power-of-approximate-reward-models-for-inference-time-scaling-sequential-monte-carlrepro-on-the-power-of-approximate-reward-models-for-inference-time-scaling-sequentialrepro-model-free-robust-average-reward-rlrepro-model-free-robust-average-reward-reinforcement-learning-with-sample-complexity-analysisrepro-velr-efficient-video-reward-feedback-via-ensemble-latent-reward-models
