Installation
Modèles de chat
UtilisezChatOpenAI avec l’URL de base de Venice :
Streaming
Embeddings
Venice n’embarque que du texte.OpenAIEmbeddings de LangChain utilise par défaut check_embedding_ctx_length=True, ce qui tokenise avec tiktoken et peut envoyer des tableaux d’entiers correspondant aux tokens. Venice les rejette avec HTTP 400, il faut donc définir check_embedding_ctx_length=False.
Chaînes
Chaîne simple avec un modèle de prompt
Chaîne séquentielle
Pipeline RAG
Construisez un pipeline de génération augmentée par récupération (RAG) avec Venice :Function calling avec des agents
Sortie structurée
Intégration de la recherche web
Utilisez la recherche web intégrée de Venice viavenice_parameters :
Modèles recommandés pour LangChain
Voir tous les modèles
Parcourez tous les modèles Venice avec leur tarification et leurs capacités