モデル選定

オフポリシー学習

# オフポリシー学習

Tqc PandaPickAndPlace V1

これはTQCアルゴリズムに基づく深層強化学習モデルで、PandaPickAndPlace-v1環境向けに設計されており、ロボットアームの把持と配置タスクに使用されます。

分子モデル

Sac Walker2d V3

これはSACアルゴリズムに基づく強化学習モデルで、Walker2d-v3環境向けに設計されており、二足ロボットの歩行を制御できます。

物理学モデル

Dqn MountainCar V0

これはstable-baselines3で訓練されたDQNエージェントモデルで、MountainCar-v0環境における強化学習タスクを解決するために特別に設計されています。

分子モデル

Decision Transformer Gym Hopper Medium

これはGym Hopper環境で中程度のパフォーマンス軌跡を使用して訓練された意思決定トランスフォーマーモデルで、連続制御タスクに適しています。

物理学モデル

おすすめAIモデル

Llama 3 Typhoon V1.5x 8b Instruct

タイ語専用に設計された80億パラメータの命令モデルで、GPT-3.5-turboに匹敵する性能を持ち、アプリケーションシナリオ、検索拡張生成、制限付き生成、推論タスクを最適化

大規模言語モデル

Transformers 複数言語対応

Cadet-TinyはSODAデータセットでトレーニングされた超小型対話モデルで、エッジデバイス推論向けに設計されており、体積はCosmo-3Bモデルの約2％です。

対話システム

Transformers 英語

Roberta Base Chinese Extractive Qa

RoBERTaアーキテクチャに基づく中国語抽出型QAモデルで、与えられたテキストから回答を抽出するタスクに適しています。

質問応答システム中国語

AIbase

未来を切り開く、あなたのAIソリューション知識ベース

English 简体中文繁體中文にほんご

© 2025AIbase