将 Gemini 与 OpenAI 库结合使用

碧海醫心

发布时间：2024-11-11 15:03:01

1279人浏览过

来源于dev.to

转载

将 gemini 与 openai 库结合使用

基于这篇文章，我们现在可以将 gemini 与 openai 库一起使用。所以，我决定在这篇文章中尝试一下

目前仅提供聊天完成 api 和嵌入 api。

在本文中，我尝试使用 python 和 javascript。

python

首先，我们来搭建环境。

pip install openai python-dotenv

接下来，让我们运行以下代码。

import os

from dotenv import load_dotenv
from openai import openai


load_dotenv()
google_api_key = os.getenv("google_api_key")

client = openai(
    api_key=google_api_key,
    base_url="https://generativelanguage.googleapis.com/v1beta/"
)


response = client.chat.completions.create(
    model="gemini-1.5-flash",
    n=1,
    messages=[
        {"role": "system", "content": "you are a helpful assistant."},
        {
            "role": "user",
            "content": "explain briefly(less than 30 words) to me how ai works."
        }
    ]
)

print(response.choices[0].message.content)

返回了以下响应。

ai mimics human intelligence by learning patterns from data, using algorithms to solve problems and make decisions.

在内容字段中，您可以指定字符串或“类型”：“文本”。

import os

from dotenv import load_dotenv
from openai import openai


load_dotenv()
google_api_key = os.getenv("google_api_key")

client = openai(
    api_key=google_api_key,
    base_url="https://generativelanguage.googleapis.com/v1beta/"
)

response = client.chat.completions.create(
    model="gemini-1.5-flash",
    n=1,
    messages=[
        {"role": "system", "content": "you are a helpful assistant."},
        {
            "role": "user",
            "content": [
                {
                    "type": "text",
                    "text": "explain briefly(less than 30 words) to me how ai works.",
                },
            ]
        }
    ]
)

print(response.choices[0].message.content)

但是，图像和音频输入出现错误。

图像输入示例代码

Dbsite企业网站管理系统1.5.0

Dbsite企业网站管理系统V1.5.0 秉承"大道至简邦达天下"的设计理念,以灵巧、简单的架构模式构建本管理系统。可根据需求可配置多种类型数据库（当前压缩包支持Access）.系统是对多年企业网站设计经验的总结。特别适合于中小型企业网站建设使用。压缩包内包含通用企业网站模板一套，可以用来了解系统标签和设计网站使用。QQ技术交流群：115197646 系统特点：1.数据与页

下载

import os

from dotenv import load_dotenv
from openai import openai


load_dotenv()
google_api_key = os.getenv("google_api_key")

client = openai(
    api_key=google_api_key,
    base_url="https://generativelanguage.googleapis.com/v1beta/"
)

# png to base64 text
import base64
with open("test.png", "rb") as image:
    b64str = base64.b64encode(image.read()).decode("utf-8")

response = client.chat.completions.create(
    model="gemini-1.5-flash",
    # model="gpt-4o",
    n=1,
    messages=[
        {"role": "system", "content": "you are a helpful assistant."},
        {
            "role": "user",
            "content": [
                {
                    "type": "text",
                    "text": "describe the image in the image below.",
                },
                {
                    "type": "image_url",
                    "image_url": {
                        "url": f"data:image/png;base64,{b64str}"
                    }
                }
            ]
        }
    ]
)

print(response.choices[0].message.content)

音频输入示例代码

import os

from dotenv import load_dotenv
from openai import openai


load_dotenv()
google_api_key = os.getenv("google_api_key")

client = openai(
    api_key=google_api_key,
    base_url="https://generativelanguage.googleapis.com/v1beta/"
)

# png to base64 text
import base64
with open("test.wav", "rb") as audio:
    b64str = base64.b64encode(audio.read()).decode("utf-8")

response = client.chat.completions.create(
    model="gemini-1.5-flash",
    # model="gpt-4o-audio-preview", 
    n=1,
    modalities=["text"],
    messages=[
        {"role": "system", "content": "you are a helpful assistant."},
        {
            "role": "user",
            "content": [
                {
                    "type": "text",
                    "text": "what does he say?",
                },
                {
                    "type": "input_audio",
                    "input_audio": {
                        "data": b64str,
                        "format": "wav",
                    }
                }
            ]
        }
    ]
)

print(response.choices[0].message.content)

返回了以下错误响应。

openai.badrequesterror: error code: 400 - [{'error': {'code': 400, 'message': 'request contains an invalid argument.', 'status': 'invalid_argument'}}]

目前仅支持文字输入，不过后续似乎会支持图片和音频输入。

javascript

让我们看一下 javascript 示例代码。

首先，我们来搭建环境。

npm init -y
npm install openai
npm pkg set type=module

接下来，让我们运行以下代码。

import openai from "openai";

const google_api_key = process.env.google_api_key;
const openai = new openai({
    apikey: google_api_key,
    baseurl: "https://generativelanguage.googleapis.com/v1beta/"
});

const response = await openai.chat.completions.create({
    model: "gemini-1.5-flash",
    messages: [
        { role: "system", content: "you are a helpful assistant." },
        {
            role: "user",
            content: "explain briefly(less than 30 words) to me how ai works",
        },
    ],
});

console.log(response.choices[0].message.content);

运行代码时，请确保在 .env 文件中包含 api 密钥。 .env 文件将在运行时加载。

node --env-file=.env run.js

返回了以下响应。

AI systems learn from data, identify patterns, and make predictions or decisions based on those patterns.

我们可以在同一个库中使用其他模型，这真是太棒了。

就我个人而言，我对此感到很高兴，因为 openai 使编辑对话历史记录变得更加容易。

如何将本地文件内容插入 MySQL 数据表

如何在Python中结合if语句与while循环实现动态列表输入

Python 为什么不推荐复杂继承体系？

Python 并发程序为何难以测试？

Python 数据结构如何影响算法复杂度？

相关专题

python开发工具

php中文网为大家提供各种python开发工具，好的开发工具，可帮助开发者攻克编程学习中的基础障碍，理解每一行源代码在程序执行时在计算机中的过程。php中文网还为大家带来python相关课程以及相关文章等内容，供大家免费下载使用。

760

2023.06.15

python打包成可执行文件

本专题为大家带来python打包成可执行文件相关的文章，大家可以免费的下载体验。

639

2023.07.20

python能做什么

python能做的有：可用于开发基于控制台的应用程序、多媒体部分开发、用于开发基于Web的应用程序、使用python处理数据、系统编程等等。本专题为大家提供python相关的各种文章、以及下载和课程。

762

2023.07.25

format在python中的用法

Python中的format是一种字符串格式化方法，用于将变量或值插入到字符串中的占位符位置。通过format方法，我们可以动态地构建字符串，使其包含不同值。php中文网给大家带来了相关的教程以及文章，欢迎大家前来阅读学习。

618

2023.07.31

python教程

Python已成为一门网红语言，即使是在非编程开发者当中，也掀起了一股学习的热潮。本专题为大家带来python教程的相关文章，大家可以免费体验学习。

1265

2023.08.03

python环境变量的配置

Python是一种流行的编程语言，被广泛用于软件开发、数据分析和科学计算等领域。在安装Python之后，我们需要配置环境变量，以便在任何位置都能够访问Python的可执行文件。php中文网给大家带来了相关的教程以及文章，欢迎大家前来学习阅读。

549

2023.08.04

python eval

eval函数是Python中一个非常强大的函数，它可以将字符串作为Python代码进行执行，实现动态编程的效果。然而，由于其潜在的安全风险和性能问题，需要谨慎使用。php中文网给大家带来了相关的教程以及文章，欢迎大家前来学习阅读。

579

2023.08.04

scratch和python区别

scratch和python的区别：1、scratch是一种专为初学者设计的图形化编程语言，python是一种文本编程语言；2、scratch使用的是基于积木的编程语法，python采用更加传统的文本编程语法等等。本专题为大家提供scratch和python相关的文章、下载、课程内容，供大家免费下载体验。

709

2023.08.11