經過漫長的等待,OpenAI(https://openai.com/)終於發佈了新的GPT-4模型——對流行的ChatGPT系統背後的核心結構以及GPT-3.5 API進行了重大更新。新的 GPT-4 版本中發生了很多事情。

根據 OpenAI 提供的早期示例、API 文檔和代碼示例,以下是有關該項目需要了解的關鍵信息:

該項目是多式聯運的。這是什麼意思?

在 GPT-4 發布之前,有許多關於該專案是否會保持像 ChatGPT 那樣的純文字模型,還是變成多模式的猜測。 多模態模型能夠處理多種媒體類型,包括輸出和輸入,從文字到圖像,最後到影片。

目前,GPT-4 支援輸入和輸出影像。最初,此功能僅適用於一家幫助 OpenAI 測試影像處理的第三方公司。 隨著系統變得更快,更多用戶將可以使用圖像作為輸入。

但 OpenAI 有一些例子說明了這一點如何最終發揮作用。一個例子包括一張雞蛋和麵粉的照片以及與烹飪相關的查詢。 GPT-4推薦可以使用照片中所示成分製作的食譜。 該模型還可用於創建圖像標題或為網站上的圖像編寫令人驚嘆的替代文字。該影片尚不可用,但由於 GPT-4 是多模式的,因此很可能會出現。

OpenAI 將幾乎立即提供對新模型的 API 存取。許多公司已經與 OpenAI 的現有 API 集成,因此遷移到 GPT-4 很容易。預設情況下,GPT-4 可以處理 8,000 個令牌,即大約 50 頁文字。

處理更多的數據將使系統能夠處理更多的指令,撰寫更長的文章,甚至可能撰寫很長的文檔或完整的文學作品。 神經網路的發展確實正在突飛猛進,在不久的將來我們將看到不斷的更新。