OpenThoughts-Agent:エージェント型AIモデル向けデータ準備の方法論
・エージェント型言語モデルの学習データ作成方法が未公開のため、OT-Agent プロジェクトが完全オープンなデータ準備パイプラインを提案 ・既存の SWE-Smith、SERA、Nemotron-Terminal などは単一ベンチマーク対応で、複数の異なるエージェントタスクに汎化するモデル開発の課題が残存 ・複数の多様なエージェントタスク領域にわたって学習可能なデータセット構築手法を公開することで、エージェント型 AI の開発障壁を低減

