メインコンテンツへスキップ

Groq

Open In Colab
セットアップなしでWeaveでGroqモデルを試してみたいですか?LLMプレイグラウンドをお試しください。
Groqは高速なAI推論を提供するAIインフラストラクチャ企業です。GroqのLPU™推論エンジンは、優れた計算速度、品質、エネルギー効率を提供するハードウェアとソフトウェアのプラットフォームです。WeaveはGroqチャット完了呼び出しを使用して行われた呼び出しを自動的に追跡し、ログに記録します。

トレーシング

言語モデルアプリケーションのトレースを開発中も本番環境でも中央の場所に保存することが重要です。これらのトレースはデバッグに役立ち、アプリケーションの改善に役立つデータセットとしても機能します。 WeaveはGroqのトレースを自動的にキャプチャします。追跡を開始するには、weave.init(project_name="<YOUR-WANDB-PROJECT-NAME>")を呼び出し、通常通りライブラリを使用します。

独自のオペレーションを追跡する

関数を@weave.opでラップすると、入力、出力、アプリケーションロジックのキャプチャが開始され、データがアプリケーションをどのように流れるかをデバッグできます。オペレーションを深くネストして、追跡したい関数のツリーを構築できます。これにより、gitにコミットされていないアドホックな詳細をキャプチャするために、実験するときにコードの自動バージョン管理も開始されます。 単に@weave.opでデコレートされた関数を作成します。 以下の例では、recommend_places_to_visitという関数があり、これは@weave.opでラップされた都市で訪れるべき場所を推薦する関数です。

Modelを作成して実験を容易にする

多くの要素が動いているとき、実験の整理は難しくなります。Modelクラスを使用することで、システムプロンプトや使用しているモデルなど、アプリの実験的な詳細をキャプチャして整理できます。これにより、アプリの異なるイテレーションを整理して比較するのに役立ちます。 コードのバージョン管理と入出力のキャプチャに加えて、Modelはアプリケーションの動作を制御する構造化されたパラメータをキャプチャし、どのパラメータが最も効果的だったかを簡単に見つけることができます。また、Weave Modelsをserve、およびEvaluationと一緒に使用することもできます。 以下の例では、GroqCityVisitRecommenderを実験できます。これらのいずれかを変更するたびに、新しいversionGroqCityVisitRecommenderが得られます。

Weave Modelの提供

任意のweave.Modelオブジェクトへのweave参照が与えられた場合、fastapiサーバーを起動してserveすることができます。 ターミナルで次のコマンドを使用してモデルを提供できます: