Search

Few direct matches — filled in with the latest updates.

Tag: #multilingual-code1 results

SWE-rebench-V2: Largest Open Coding Dataset

SWE-rebench-V2: Largest Open Coding Dataset

Nebius releases SWE-rebench-V2, the world's largest open dataset for training coding agents with over 32,000 executable tasks across 20 languages. It includes 120,000+ tasks from real pull requests, filtered for quality using LLM ensembles. A technical report and leaderboard are also available.

Reddit r/LocalLLaMACommunityMar 3#dataset#rl-training#multilingual-code