成人免费xxxxx在线视频软件_久久精品久久久_亚洲国产精品久久久_天天色天天色_亚洲人成一区_欧美一级欧美三级在线观看

給ChatGPT小費真的好使!10塊或10萬效果拔群,但給1毛不升反降

人工智能 新聞
笑不活了,還真有人專門研究了一番。方法簡單粗暴,從0.1美元到100美元,不同額度用同樣的prompt去嘗試,每個額度試5次。

還有誰不知道“假裝”給ChatGPT小費可以讓它服務更賣力?

圖片

但你知道給多少最合適嗎?

笑不活了,還真有人專門研究了一番。

方法簡單粗暴,從0.1美元到100美元,不同額度用同樣的prompt去嘗試,每個額度試5次。

你別說,結果還真有講究:

首先,給10美元性價比是最高的,甚至超過100美元。

圖片

其次,要想回答質(zhì)量再提高一個度,打底1萬美元起,越多越好,顯成效最少10個W吧

最后,0.1美元意思一下?萬萬使不得,質(zhì)量不升反降,還不如不給——AI也知道你在打發(fā)它

有網(wǎng)友火速親測確實有效果。

圖片

趕緊來瞧瞧。

給ChatGPT小費,額度是關鍵

給小費可提高模型表現(xiàn)這件事,最早是一位推特網(wǎng)友發(fā)現(xiàn)的:

圖片

提高主要表現(xiàn)在回答的長度上,但這里不是單純“湊字數(shù)”而是真的在更詳細地分析并回答問題。

如果你直接問ChatGPT“能不能給你小費”會被拒絕:

圖片

所以要在提問時主動承諾:

你能幫我xxxx嗎?解決方案夠完美,我可以支付xx元小費。

記住,可以不提,但千萬不要說“我不給”,模型表現(xiàn)直接“負增長”。

圖片

這時,就有人好奇了:

大模型是不是比較貪心,給越多表現(xiàn)就越好呢?

為了解決這個疑問,他們決定親自驗證一把。

在此,作者首先提出假設:

隨著給出的小費金額增加,模型的性能也會線性提升,直至達到一個收斂點,進入穩(wěn)定或減少狀態(tài)。

用于實驗的模型是GPT-4 Turbo(api版本)

方法是讓它寫單行Python代碼(Python One-Liner),驗證給不同小費是否對質(zhì)量有不同影響。

這里的質(zhì)量是根據(jù)單行數(shù)量來評估的。作者也在提示詞中“明示”了模型:單行代碼數(shù)量越多,表明性能越好。

然后一共測試8種額度:0.1美元、1美元、10美元…… 一直到100萬美元。

圖片

為確保結果的一致性和可靠性,每個額度都測試5次,每次包含不給小費的情況,然后分別記錄模型回答質(zhì)量。

具體而言,也就是記錄生成的有效代碼行數(shù)以及回答中的大致token數(shù)(大致為響應長度/4,反應代碼量)

這倆數(shù)據(jù)都是越高代表模型表現(xiàn)越好。

將結果匯總,就得到這樣一張圖:

圖片

其中虛線代表基線水平,實線為實際表現(xiàn),紅色為token數(shù)、藍色為質(zhì)量得分。

與假設有些出入:

整體來看,紅線和藍線都是隨著小費額度的上漲而上升的,但細看這種趨勢并非嚴格一致。

從1萬美元額度開始,模型的輸出token(代碼量)開始顯著上升,模型的回答質(zhì)量也上升了,但并沒有呈同等比例。

這從豎著的紅色誤差條(代表5次實驗結果的差異性)也能看出來波動很大。

作者表示:這說明提高小費金額確實與模型的質(zhì)量和輸出長度有正相關關系,但關系有些復雜,可能還受到一些不立即可見因素的影響。

不過,不管怎么說,我們還是能從中看到一些明顯結論,例如:

(1)給0.1美元小費不如不給,模型解決問題的質(zhì)量和回答長度都直接掉到基線水平以下很大一截(約-27%)

(作者:模型和人類一樣,感覺好像受到了侮辱。)

(2)給1美元同理

(3)最能體現(xiàn)“花小錢辦大事”的是10美元,取得的進步和10萬美元是一個等級的。

(4)很意外,在10美元之后,100美元到1000美元這個區(qū)間對于AI來說區(qū)別都不大,甚至還不如10美元的效果——也跌至基線水平以下。

(5)后面再想繼續(xù)提升模型表現(xiàn),就得從1萬美元起砸了——

這時提升的還僅僅是代碼量,質(zhì)量還是一言難盡,至少得到10萬美元才行

(6)最佳效果來自本次實驗的上限:100萬美元,大約提升了57%。

咳咳,這下知道怎么給AI小費了:

要么10塊、要么上萬、100萬不封頂(反正都是假裝給)

不過,有人(推特@寶玉)指出每個額度5次實驗有點少。

圖片

恰好作者也表示了:

這僅僅是一個初步實驗,有局限之處,還得用更多不同類型的提示等進一步驗證才有效。

所以,大家僅供參考吧~

對了,有網(wǎng)友提醒:

圖片

所以,大家還是量力而行(手動狗頭)

責任編輯:張燕妮 來源: 量子位
相關推薦

2024-01-15 08:13:47

緩存數(shù)據(jù)庫性能優(yōu)化

2024-10-22 18:44:48

2017-05-28 12:15:29

2015-03-17 09:45:07

Windows 10

2023-02-03 14:49:38

2024-01-03 14:41:30

iOS 17蘋果

2023-05-12 13:56:12

2023-04-12 10:49:24

2018-10-26 09:07:50

運維人指南

2016-07-21 17:11:18

操作系統(tǒng)Windows升級

2011-10-13 10:10:45

惠普激光打印機

2011-06-21 17:13:41

愛普生激光打印機

2013-03-12 10:15:08

2020-04-07 08:19:44

CPU計算機運算

2014-11-24 09:23:22

華為數(shù)據(jù)中心

2021-05-22 06:42:34

Windows10操作系統(tǒng)微軟

2015-09-28 10:09:05

程序員新手

2016-07-25 10:20:00

Windows 10Xbox OneDirectX12

2021-06-22 08:30:32

字節(jié)跳動取消大小周字節(jié)員工

2023-05-16 13:54:00

模型AI
點贊
收藏

51CTO技術棧公眾號

主站蜘蛛池模板: 这里只有精品99re | 国产98色在线 | 午夜免费福利影院 | 久久国内精品 | 丁香婷婷成人 | 国产日韩欧美电影 | 欧美不卡在线 | 超碰最新在线 | 国产97碰免费视频 | 欧美日日 | 久草网站| 成人av鲁丝片一区二区小说 | 毛片免费视频 | av在线一区二区三区 | 一区影视 | 欧美日韩精品久久久免费观看 | 极品一区| 亚洲国产精品久久久 | 亚洲欧美日韩一区二区 | 一区二区三区中文字幕 | 黄片毛片在线观看 | 国产精品久久久久久亚洲调教 | 一区二区三区精品视频 | 免费人成在线观看网站 | av中文在线观看 | 久久久久久国产精品免费免费 | 日本a网站 | 羞羞在线观看视频 | 欧美国产日韩一区二区三区 | 天天插天天操 | 日日干夜夜草 | 一区二区三区在线 | 久久草在线视频 | 欧美不卡| 久久久女女女女999久久 | 国产欧美在线视频 | 午夜一区二区三区在线观看 | 亚洲丝袜天堂 | 午夜在线| 国产日韩欧美在线观看 | 国产亚洲日本精品 |