In den Nachrichten von币界网 hat Prime Intellect bekannt gegeben, dass ihre Agenten-Nachtrainingsplattform Lab vom Beta-Stadium in die offizielle Version übergeht. Diese Plattform bewertet, integriert Reinforcement Learning (RL) Training, Adapterbereitstellung und Inferenz zu einem geschlossenen Kreislauf. Nutzer können Aufgaben und Bewertungsstandards definieren, während die Plattform automatisch Modelle anstößt, um in den Aufgaben durch Trial-and-Error zu lernen, Belohnungssignale zu sammeln und Lora-Adapter zu trainieren. Die Abrechnung erfolgt nach Token und nicht nach GPU-Nutzungsdauer, basierend auf dem unternehmensinternen Open-Source-Prime-RL-Framework. Die erste Runde von Lab unterstützt 14 Modelle von Nvidia, OpenAI, Meta und Qwen, mit Parametern von 1B bis 70B, die sowohl dichte als auch MOE-Architekturen abdecken. Prime Intellect wurde 2023 gegründet und hat insgesamt über 70 Millionen Dollar an Finanzierung erhalten, wobei die A-Runde von Founders Fund geleitet wurde und die B-Runde von Radical Ventures.