Luckeciano Carvalho Melo's picture

Luckeciano Carvalho Melo

luckeciano

·

https://luckeciano.github.io

AI & ML interests

Reinforcement Learning

Organizations

Papers 1

arxiv:2206.06614

models 1,128

luckeciano/Llama-3.1-8B-Instruct-CAPO-Base-v2-FisherMaskToken-1e-10-HessianMaskToken-0.0-LR-7.5e-7_2916

Updated Nov 20, 2025

luckeciano/Llama-3.1-8B-Instruct-CAPO-Base-v2-FisherMaskToken-1e-9-HessianMaskToken-0.0-LR-7.5e-7_9573

Updated Nov 20, 2025

luckeciano/Llama-3.1-8B-Instruct-CAPO-Base-v2-FisherMaskToken-1e-8-HessianMaskToken-0.0-LR-7.5e-7_8245

Updated Nov 19, 2025

luckeciano/Llama-3.1-8B-Instruct-CAPO-Base-v2-FisherMaskToken-1e-7-HessianMaskToken-0.0-LR-7.5e-7_3803

Updated Nov 19, 2025

luckeciano/Llama-3.1-8B-Instruct-CAPO-FisherMaskToken-1e-4-5e-7-HessianMaskToken-0.005-LR-7.5e-7_9528

Updated Nov 19, 2025

luckeciano/Llama-3.1-8B-Instruct-CAPO-FisherMaskToken-1e-4-1e-6-HessianMaskToken-0.005-LR-7.5e-7_1755

Updated Nov 19, 2025

luckeciano/Llama-3.1-8B-Instruct-CAPO-Base-v2-FisherMaskToken-1e-6-HessianMaskToken-0.0-LR-7.5e-7_5828

Updated Nov 19, 2025

luckeciano/Llama-3.1-8B-Instruct-CAPO-Base-v2-FisherMaskToken-1e-5-HessianMaskToken-0.0-LR-7.5e-7_7105

Updated Nov 19, 2025

luckeciano/Llama-3.1-8B-Instruct-CAPO-Base-v2-FisherMaskToken-1e-5-HessianMaskToken-0.01-LR-7.5e-7_8346

Updated Nov 19, 2025

luckeciano/Llama-3.1-8B-Instruct-CAPO-Base-v2-FisherMaskToken-1e-4-HessianMaskToken-0.005-LR-7.5e-7_8590

Updated Nov 19, 2025

View 1,128 models

datasets 19

luckeciano/pku-llama3.1-8b-dataset-test-generations

Viewer • Updated Jan 31, 2025 • 4.7M • 3

luckeciano/pku-llama3.1-8b-dataset-train-generations

Viewer • Updated Jan 31, 2025 • 1.36M • 6

luckeciano/pku-alpaca3.1-8b-eval-gt-rewards

Viewer • Updated Sep 20, 2024 • 4.7k • 3

luckeciano/pku-alpaca3.1-8b-gt-rewards

Viewer • Updated Sep 10, 2024 • 6.05M • 4

luckeciano/pku-llama3.1-8b-answers-features-test

Viewer • Updated Sep 8, 2024 • 4.42M • 5

luckeciano/pku-llama3.1-8b-answers-features-train

Viewer • Updated Sep 6, 2024 • 1.28M • 6

luckeciano/pku-llama3.1-8b-dataset-features-gt-reward-modeling

Updated Sep 4, 2024 • 30

luckeciano/pku-llama3.1-8b-dataset-features

Viewer • Updated Sep 3, 2024 • 18.3k • 5

luckeciano/PKU-SafeRLHF-Shifts

Viewer • Updated Aug 26, 2024 • 18.3k • 3

luckeciano/mistral8x22b-reddit-post-features

Viewer • Updated May 10, 2024 • 92.9k • 53

View 19 datasets