ChatGPT吃食人族
ChatGPT的热度开始减退,谷歌搜索ChatGPT的次数比4月份的峰值下降了40%,而OpenAI的ChatGPT网站的网络流量在过去一个月也下降了近10%。
然而,这完全在意料之中,GPT-4的用户也报告称,该模型似乎比以前明显更傻(但更快)。一种理论是OpenAI将其拆分为多个训练特定领域的小模型,它们可以协同工作,但无法达到同一水平。
但一个更有趣的可能性也可能在发挥作用:AI食人族。
网络现在充斥着AI生成的文本和图像,这些合成数据被抓取作为训练AI的数据,导致负反馈循环。一个模型摄入的AI数据越多,输出在连贯性和质量上的表现就越差。这有点像复印复印件时,图像逐渐变得更糟。
虽然GPT-4的官方训练数据截至2021年9月,但它显然知道的远不止这些,OpenAI最近关闭了其网页浏览插件。
来自莱斯大学和斯坦福大学的科学家们提出了一个可爱的缩略语来描述这个问题:模型自噬障碍或MAD。
“我们在所有场景中的主要结论是,如果每一代的自噬循环中没有足够的新鲜真实数据,未来的生成模型注定要在质量(精度)或多样性(召回率)上逐渐下降,”他们说。
本质上,这些模型开始失去更独特但代表性较差的数据,并在较少变化的数据上使输出变得更为严谨,形成一个持续的过程。好消息是,这意味着如果我们能够找到一种方法来识别和优先考虑人类内容,AI现在有理由保持人类参与。这是OpenAI首席执行官萨姆·奥特曼与他的眼球扫描区块链项目Worldcoin计划之一。
Threads只是为了训练AI模型而推出的亏损领导者吗?
Twitter克隆Threads是马克·扎克伯格的一项奇怪举动,因为它从Instagram中抢夺用户。这个照片分享平台每年赚取高达500亿美元,但在Threads上赚取的收入可能只有这个数字的十分之一,即使在它从Twitter获取100%市场份额的非现实情况下。Big Brain Daily的亚历克斯·瓦莱蒂斯预测,它将在12个月内被关闭或重新整合到Instagram中,并认为其推出的真正原因是为了拥有更多基于文本的内容,以训练Meta的AI模型。”
ChatGPT是在大量来自Twitter的数据上训练的,但埃隆·马斯克采取了各种不受欢迎的措施来阻止这种情况未来发生(收费API访问、速率限制等)。
扎克在这方面有过类似的经历,因为Meta的图像识别AI软件SEER是在Instagram上发布的十亿张照片上训练的。用户在隐私政策中同意了这一点,许多人注意到Threads应用程序收集了所有可能的数据,从健康数据到宗教信仰和种族。这些数据将不可避免地用于训练像Facebook的LLaMA(大型语言模型Meta AI)这样的AI模型。与此同时,马斯克刚刚推出了一款名为xAI的OpenAI竞争者,它将挖掘Twitter的数据以建立自己的LLM。
谁会想到在宗教文本上训练AI并以上帝的声音说话会是个糟糕的主意?在印度,假装成克里希纳的印度教聊天机器人一直在不断地告诫用户,如果这是你的dharma(义务),杀人是可以的。
在过去几个月中,至少有五个基于《博伽梵歌》的聊天机器人出现,但尽管存在伦理担忧,印度政府没有计划对这项技术进行监管。
“这是误传,是基于宗教文本的信息错误,”孟买的律师卢布娜·优素福说,她是《AI书》的共同作者。文本给他们想要表达的内容赋予了很多哲学价值,而机器人能做什么?它给你一个字面上的答案,这就是这里的危险。”
另请阅读 特写
Lushsux:十年的打击与阴谋在一个NFT中
特色 进入韩国主导元宇宙的疯狂计划 AI悲观主义者与AI乐观主义者
世界上首屈一指的AI悲观主义者、决策理论家埃利泽·尤德科夫斯基发布了一场TED演讲,警告超级智能AI将杀死我们所有人。他不确定如何或为什么,因为他认为AGI将比我们聪明得多,我们甚至无法理解它是如何以及为什么杀死我们的,就像中世纪的农民试图理解空调的运作一样。它可能会因为追求其他目标而杀死我们,或者因为它不希望我们制造其他超级智能来与之竞争。”
他指出,没有人理解现代AI系统是如何运作的。它们是巨大的无法理解的浮点数矩阵。他并不期望“带着发光红眼的机器人军队”,但相信一个更聪明且漠不关心的实体将会找到能够快速、可靠地杀死我们的策略和技术,然后杀死我们。唯一可以阻止这种情景发生的事情是全球范围内的技术禁令,背后要有第三次世界大战的威胁,但他认为这不会发生。
在他的文章《为什么AI将拯救世界》中,A16z的马克·安德森认为这种立场是非科学的:可测试的假设是什么?什么会反驳这一假设?我们如何知道何时进入危险区域?除了“你无法证明它不会发生!”这些问题几乎没有得到回答。
微软首席执行官比尔·盖茨发布了他自己的文章,标题为“AI的风险是真实的但可控的”,他认为,从汽车到互联网,“人们已经在其他变革时刻中成功应对,尽管经历了很多波动,最终处境更好。”
“这是我们这一生中所见的最具变革性的创新,健康的公共辩论将取决于每个人都对技术、其益处和风险有足够的了解。其益处将是巨大的,而我们能够管理风险的最好理由是我们以前做过。”
数据科学家杰罗米·霍华德发布了自己的论文,认为任何试图禁止这项技术或限制其只应用于少数大型AI模型的尝试都将是灾难性的,他将基于恐惧的回应与启蒙前时代人类试图将教育和权力限制在精英手中进行比较。
另请阅读 特写 你应该给孩子们打橙色药丸吗?比特币儿童书的案例 特写 涉及DAO的法律风险
“然后一个新想法产生了。如果我们相信整个社会的整体利益会怎样?如果每个人都能接受教育呢?能投票呢?能使用技术呢?这是启蒙时代。”
他的反提案是鼓励AI的开源开发,并相信大多数人会利用这项技术为善。
“大多数人将使用这些模型进行创造和保护。如何更安全呢?那就是让人类社会的巨大多样性和专业知识全力以赴地识别和应对威胁,而AI则在背后提供全力支持!”
OpenAI的代码解释器
GPT-4的新代码解释器是一个极好的新升级,允许AI按需生成代码并实际运行。因此,您可以想象的任何内容,它都可以为其生成代码并运行。用户们提出了各种应用案例,包括上传公司报告并让AI生成关键数据的有用图表、将文件从一种格式转换为另一种格式、创建视频效果和将静态图像转化为视频。一名用户上传了美国每个灯塔位置的Excel文件,并让GPT-4创建了一个位置的动画地图。
所有杀手,没有填充 AI新闻
蒙大拿大学的研究发现,人工智能在创造力标准化测试中得分位于前1%。学术测试服务给GPT-4的测试反应在创造力、流畅性(产生大量想法的能力)和原创性方面给予了最高分。
喜剧演员莎拉·西尔弗曼和作家克里斯托弗·戈尔登及理查德·卡德雷正在起诉OpenAI和Meta侵犯版权,因为他们的各自AI模型是以三人的书籍为训练材料。
微软的Windows AI Copilot最终将会非常棒,但Windows Central发现内部预览其实只是通过Edge浏览器运行的Bing Chat,并且它只能打开蓝牙。
Anthropic的ChatGPT竞争者Claude 2现在在英国和美国免费提供,其上下文窗口可以处理75,000个字的内容,而ChatGPT的最大值为3,000个字。这使得它在总结长篇文本方面表现出色,并且在写作小说方面也不差。
本周视频
印度卫星新闻频道OTV News推出了其AI新闻主播Lisa,她将在网络及其数字平台上每天多次以多种语言(包括英语和奥里亚语)播报新闻。OTV的董事总经理贾基·曼戈特·潘达表示,这些新的AI主播是根据使用合成声音的新闻播报员的镜头创建的数字合成体。
订阅 区块链中最引人入胜的阅读。每周一次。
电子邮件地址
订阅
