测试了下OpenAI的视觉功能也就是读图能力,新发布的模型:"gpt-4-vision-preview"就有处理图片的能力。先找到模型的代码:
import OpenAI from "openai"
//"openai": "^4.16.1",新版本的方法
import dotEnv from "dotenv"
dotEnv.config()
const apiKey = process.env.API_KEY
const Openai = new OpenAI({
apiKey: apiKey
})
async function main() {
const response = await Openai.chat.completions.create({
model: "gpt-4-vision-preview",
messages: [
{
role: "user",
content: [
{ type: "text", text: "图片里有什么" },
{
type: "image_url",
image_url: {
"url": "https://ipfs.ilark.ioxx.jpg",
},
},
],
},
],
});
console.log(65, response.choices[0])
}
main()
速度有点小慢,读图可能要耗费更长的时间。
结果:'图片展示了几件绿色的陶瓷',是挺对的!
看来OpenAI又要推出一些好玩的东东来了,据称GPT store也在安排中,未来可期。