訂閱
糾錯
加入自媒體

OpenAI o1預(yù)覽模型發(fā)布:推理能力更強(qiáng) 可達(dá)理科博士生水準(zhǔn)

2024-09-13 09:11
快科技
關(guān)注

快科技9月13日消息,今日凌晨,OpenAI正式推出了OpenAI o1預(yù)覽模型。

對于復(fù)雜推理任務(wù)而言,新模型代表著人工智能能力的嶄新水平,其特點(diǎn)就是會在回答之前花更多時間進(jìn)行思考,就像人類思考解決問題的過程一樣。

OpenAI o1預(yù)覽模型發(fā)布:推理能力更強(qiáng) 可達(dá)理科博士生水準(zhǔn)

OpenAI曾解釋過,2023年發(fā)布的GPT-4類似于高中生的智能水平,而GPT-5則是完成AI從“高中生躍升至博士”的成長,o1模型就是其中關(guān)鍵的一步。

根據(jù)測試,o1模型在國際數(shù)學(xué)奧林匹克的資格考試中,能夠拿到83%的分?jǐn)?shù),而GPT-4o只能正確解決13%的問題。

而在編程能力比賽Codeforces中,o1模型拿到89%百分位的成績,而GPT-4o只有11%。

OpenAI o1預(yù)覽模型發(fā)布:推理能力更強(qiáng) 可達(dá)理科博士生水準(zhǔn)

OpenAI表示,根據(jù)測試,在下一個更新的版本中,AI在物理、化學(xué)和生物學(xué)的挑戰(zhàn)性基準(zhǔn)測試中,表現(xiàn)能夠與博士生水平類似。

相較于GPT-4o等現(xiàn)有的大模型,OpenAI o1能夠解決更加困難的推理問題,同時改善過往模型中存在的機(jī)制性缺陷。

比如在解答編程問題時也會更有條理,在著手寫代碼前,把整個回答的流程全部思考完一遍,再動手輸出代碼。

OpenAI o1預(yù)覽模型發(fā)布:推理能力更強(qiáng) 可達(dá)理科博士生水準(zhǔn)

o1會花更多時間思考

在o1模型中,AI會不斷試錯并打磨答案,從而顯著提高生成結(jié)果的準(zhǔn)確率和質(zhì)量。

OpenAI 宣布,ChatGPT訂閱用戶從9月12日起可以訪問這兩個新模型,o1-preview每周消息數(shù)量限制為30條,o1-mini則為50條。

作者:建嘉來源:快科技

       原文標(biāo)題 : OpenAI o1預(yù)覽模型發(fā)布:推理能力更強(qiáng) 可達(dá)理科博士生水準(zhǔn)

聲明: 本文由入駐維科號的作者撰寫,觀點(diǎn)僅代表作者本人,不代表OFweek立場。如有侵權(quán)或其他問題,請聯(lián)系舉報。

發(fā)表評論

0條評論,0人參與

請輸入評論內(nèi)容...

請輸入評論/評論長度6~500個字

您提交的評論過于頻繁,請輸入驗證碼繼續(xù)

暫無評論

暫無評論

    人工智能 獵頭職位 更多
    掃碼關(guān)注公眾號
    OFweek人工智能網(wǎng)
    獲取更多精彩內(nèi)容
    文章糾錯
    x
    *文字標(biāo)題:
    *糾錯內(nèi)容:
    聯(lián)系郵箱:
    *驗 證 碼:

    粵公網(wǎng)安備 44030502002758號