Prime Intellect、検証者 0.2.0 をリリース。タスク定義をエージェントの実行から切り離し
Beatingによると、AIトレーニングプラットフォームのPrime IntellectがVerifiers 0.2.0をリリースし、次世代のVerifiers v1アーキテクチャをプレビューした。VerifiersはAIエージェントをテストしスコアリングするためのオープンソースのフレームワークであり、新たにオープンソース化されたprime-rlフレームワークはタスク結果に基づいてモデルを学習する。v1アーキテクチャは、タスク定義、ツール選択、スコアリングルール(Taskset)を、エージェントの実行方式(Harness)や実行環境(Runtime)から切り離し、評価ルールを書き直すことなく、Codex、Kimi Code、Terminus 2のような異なるエージェント間で同じタスクを再利用できるようにしている。 開発者は両方のフレームワークを自社ホストすることも、Environments HubおよびLabを通じてPrime Intellectのマネージドサービスを利用することも可能だ。v1の設計は長期のタスクをサポートし、強化学習の学習用にエージェントの実行トレースを直接取得する。
GateNews·07-13 06:01



