Gemini AI:n ilmoituksen jälkeen Google on julkaissut sovellusliittymän Gemini-malleilleen. Tällä hetkellä yritys tarjoaa API-käyttöä Gemini Prolle, mukaan lukien vain teksti- ja teksti- ja visiomallit. Se on mielenkiintoinen julkaisu, koska Google ei ole toistaiseksi lisännyt visuaalista ominaisuutta Bardiin, koska se käyttää vain teksti -mallia. Tällä API-avaimella voit vihdoin testata Geminin multimodaalista suorituskykyä tietokoneellasi heti paikallisesti. Tässä oppaassa opitaan pääsemään ja käyttämään Gemini API:ta.
Huomautus:
Google Gemini API -avain on toistaiseksi ilmainen sekä teksti- että näkömalleille. Se on ilmainen yleiseen saatavuuteen asti ensi vuoden alussa. Voit siis lähettää jopa 60 pyyntöä minuutissa ilman, että sinun tarvitsee määrittää Google Cloud -laskutusta tai aiheuttaa kuluja.
Asenna Python ja Pip tietokoneellesi
- Siirry oppaaseemme ja asenna Python yhdessä Pipin kanssa PC tai Mac. Sinun on asennettava Python 3.9 tai uudempi versio.
- Jos sinulla on Linux-tietokone, voit seurata opetusohjelmaamme Pythonin ja Pipin asentamiseksi Ubuntuun tai muihin distroihin.
- Voit suorittaa alla olevat komennot terminaalissa to varmista Python ja Pip asennus tietokoneellesi. Sen pitäisi palauttaa versionumero.
python -V pip -V
- Kun asennus on onnistunut, suorita alla oleva komento asenna Googlen Generatiivinen AI riippuvuus.
pip install -q -U google-generativeai

Kuinka saada Gemini Pro API -avain
- Siirry seuraavaksi osoitteeseen makersuite.google.com/app/apikey (vierailla) ja kirjaudu sisään Google-tililläsi.
- Napsauta API-avaimet -kohdassa ”Luo API-avain uudessa projektissa”-painiketta.

- Kopioi API-avain ja pidä se yksityisenä. Älä julkaise tai jaa API-avainta julkisesti.

Gemini Pro API -avaimen käyttäminen (vain tekstimalli)
OpenAI:n tapaan Google on tehnyt Gemini API-avaimen käyttämisestä helppoa kehitys- ja testaustarkoituksiin. Olen tehnyt koodista melko yksinkertaisen tavallisen käyttäjän testattavaksi ja käytettäväksi. Tässä esimerkissä näytän kuinka Gemini Pro Text -mallia käytetään API-avaimen kautta.
- Käynnistä ensin valitsemasi koodieditori. Jos olet aloittelija, asenna se Muistio++ (vierailla). Kokeneille käyttäjille Visual Studio Code (vierailla) on loistava työkalu.
- Kopioi seuraavaksi alla oleva koodi ja liitä se koodieditoriin.
import google.generativeai as genai genai.configure(api_key=’LIITÄ API-AVAIN TÄHÄN’) model = genai.GenerativeModel(’gemini-pro’) response = model.generate_content(”Mikä on elämän tarkoitus?”) print( vastaus.teksti)
- Liitä Gemini API -avain koodieditoriin. Kuten näet, olemme määrittäneet ”gemini-pro” -mallin, joka on vain teksti -malli. Olemme myös lisänneet kyselyn, missä voit kysy kysymyksiä.

- Tallenna nyt koodi ja anna tiedostolle nimi. Muista lisätä loppuun .py. Olen nimennyt tiedostolleni gemini.py ja tallensi sen työpöydälle.

- Käynnistä sitten terminaali ja suorita alla oleva komento siirry työpöydälle.
cd työpöytä
- Kun olet päätelaitteen työpöydällä, suorita alla oleva komento suorittaa gemini.py-tiedosto Pythonilla.
python gemini.py

- Se tulee nyt vastaa kysymykseen olit asettanut gemini.py-tiedostoon.

- Voit muuta kysymystä tallenna se koodieditorissa ja suorita gemini.py-tiedosto uudelleen saadaksesi uuden vastauksen suoraan terminaaliin. Näin voit käyttää Google Gemini API -avainta päästäksesi vain tekstimuotoiseen Gemini Pro -malliin.

Gemini Pro API -avaimen käyttäminen (teksti ja visio -malli)
Tässä esimerkissä aion näyttää, kuinka voit olla vuorovaikutuksessa Gemini Pro -multimodaalimallin kanssa. Se ei ole vielä julkaistu Google Bardissa, mutta sovellusliittymän kautta pääset siihen heti. Ja onneksi prosessi on jälleen melko helppo ja saumaton.
- Avaa uusi tiedosto koodieditorissasi ja liitä alla oleva koodi.
import google.generativeai as genai import PIL.Image img = PIL.Image.open(’image.jpg’) genai.configure(api_key=’LIITÄ API-AVAIN TÄHÄN’) model = genai.GenerativeModel(’gemini-pro-vision ’) vastaus = model.generate_content([”what is the total calorie count?”, img]) tulosta(vastaus.teksti)
- Muista liittää Gemini API -avain. Tässä käytämme gemini-tarjous malli, joka on teksti-ja visiomalli.

- Tallenna nyt tiedosto työpöydällesi ja lisää .py tiedostonimen loppuun. Olen nimennyt sen geminiv.py tässä.

- Kuten näet, koodin kolmannella rivillä osoitan tekoälyn kohtaan an kuva.jpg tiedosto, joka on tallennettu työpöydälleni tarkalla nimellä. Mitä tahansa kuvaa haluat käsitellä, varmista, että se on tallennettu samaan paikkaan kuin geminiv.py-tiedosto ja että tiedostonimi on sama oikealla tunnisteella. Voit välittää paikallisia JPG- ja PNG-tiedostoja 4 megatavuun asti.

- Kuudennessa koodirivillä voit esittää kuvaan liittyviä kysymyksiä. Koska syötän ruokaan liittyvää kuvaa, pyydän Gemini Prota siihen laske kokonaiskalori laskea.
- On aika ajaa koodi terminaalissa. Siirry vain työpöydälle (minun tapauksessani) ja suorita alla olevat komennot yksitellen. Muista tallentaa tiedosto, jos olet tehnyt muutoksia.
cd Työpöytä python geminiv.py

- Visuaalinen Gemini Pro -malli vastaa kysymykseen suoraan. Voit kysyä lisäkysymyksiä ja pyytää tekoälyä tekemään selittää perustelut.

- Voit syötä eri kuva samoin, mutta varmista, että vastaat kuvatiedoston nimeä, vaihda kysymys koodissa ja suorita geminiv.py-tiedosto uudelleen saadaksesi uusia vastauksia.
Gemini Pro API -avaimen käyttäminen chat-muodossa
Ansiosta konv (GitHub) tiivistä koodia, voit keskustella Gemini Pro -mallin kanssa Terminal-ikkunassa käyttämällä Gemini AI API -avainta. Tällä tavalla sinun ei tarvitse muuttaa koodin kysymystä ja suorittaa Python-tiedostoa uudelleen saadaksesi uuden tulosteen. Voit jatkaa keskustelua itse pääteikkunassa.
Mikä parasta, Google on ottanut käyttöön chat-historian, joten sinun ei tarvitse manuaalisesti liittää vastauksia ja hallita chat-historiaa itse taulukossa tai luettelossa. Yksinkertaisella toiminnolla Google tallentaa kaiken keskusteluhistorian chatissa. Näin se toimii.
- Avaa koodieditori ja liitä alla oleva koodi.
import google.generativeai as genai genai.configure(api_key=’LIITÄ API-AVAIN TÄHÄN’) model = genai.GenerativeModel(’gemini-pro’) chat = model.start_chat() while True: message = input(”Sinä: ” ) vastaus = chat.send_message(message) print(”Kaksoset: ” + vastaus.teksti)
- Liitä sovellusliittymäavaimesi tavalliseen tapaan yllä olevien osioiden tapaan.

- Tallenna nyt tiedosto työpöydälle tai haluamaasi paikkaan. Muista lisätä loppuun .py. Olen nimennyt sen geminichat.py tiedosto.

- Käynnistä nyt pääte ja siirry työpöydälle. Suorita sen jälkeen tiedosto geminichat.py.
cd Työpöytä python geminichat.py

- Voit nyt jatkaa keskustelua vaivattomasti, ja se myös jatkuu muista chat-historia. Joten tämä on toinen loistava tapa käyttää Google Gemini API -avainta.

Joten tässä on muutamia esimerkkejä, joista voit yrittää tarkistaa Google Geminin ominaisuudet API:n kautta. Pidän siitä, että Google on tarjonnut visiomallinsa harrastajien ja kehittäjien kokeiltavaksi vertaamalla sitä OpenAI:n DALL-E 3:een ja ChatGPT:hen. Vaikka Gemini Pro vision -malli ei voita GPT-4V-mallia, se on aika hyvä kuitenkin. Odotamme Gemini Ultran julkaisua, joka on GPT-4-mallin tasolla.
Tämän lisäksi Gemini Pro API:n vastaukset tuntuvat hieman erilaisilta kuin Google Bard, joka on myös varustettu Gemini Pron hienosäädetyllä versiolla. Bardin vastaukset näyttää hieman tylsää ja desinfioituamutta Gemini Pron API-vastaukset tuntuvat elävämmiltä ja luonteeltaan.
Seuraamme kaikkia muutoksia tässä tilassa, joten pysy kuulolla saadaksesi lisää Gemini tekoälyyn liittyvää sisältöä. Sillä välin, mene eteenpäin ja tarkista Google Gemini API itse.
Tue työtämme ❤️
Jos pidit tästä artikkelista, harkitse tipin antamista, jotta voimme jatkaa laadukkaan sisällön julkaisemista.




















