OpenAI 2024年展望:Sam Altman愿望清单的深度解析

2023-12-28 15:20

本文主要是介绍OpenAI 2024年展望:Sam Altman愿望清单的深度解析,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

引言

Sam Altman 2023年11月22日 重回OpenAI 任CEO。
Sam Altman 2023年12月24日 发布新年需求统计。

OpenAI是一个美国人工智能研究实验室,由非营利组织OpenAI Inc,和其营利组织子公司OpenAI LP所组成。OpenAI 进行 AI 研究的目的是促进和发展友好的人工智能,使人类整体受益。

不知道导演和编剧是谁,但观看这出剧非常愉快。

愿望清单的概述

两个小时讨论,整理出以下需求清单,有6万多次需求回答。
在这里插入图片描述

  • AGI(请保持耐心):Sam Altman 明确表示无法在2024年实现这个目标。
  • GPT-5
  • 更好的语音模式
  • 提高访问限制
  • 更好的 GPTs
  • 更好的推理能力
  • 对觉醒/行为程度的控制
  • 视频处理/生成能力
  • 个性化定制
  • 更强的联网搜索能力
  • 使用 OpenAI 登录
  • 开源:开源ChatGPT

深度分析

AGI

AGI(Artificial General Intelligence) 通俗称为强人工智能或者通用人工智能。

AGI 能够胜任任何任务,智能水准比肩人类或者超过人类。

在这次讨论中,前2分钟 对于AGI 有非常明确需求,想要快速进入AGI时代。

Sam Altman 明确表示2024年无法实现这个目标。

OpenAI 公司战略目标AGI ,对于这个方向也在不断迭代,GPT就是为这个方向而诞生的。

GPT-5

GPT4.5 还不太确定,曾经传出12月底上市,Sam Altman 上个月曾透露正在研发GPT-5,具有更好多模态能力,优化加强文字,语音,视觉,视频等能力。
在这里插入图片描述

更好的语音模式

ChatGPT 语音功能现在已经向所有用户免费开放,它主要由 Whisper 模型提供支持。iOS 和 Android 的 ChatGPT 移动应用程序均提供该语音功能。

Whisper是一个端到端的语音识别系统,可将英语语音转录为文本。它通过Transformer架构,在680,000小时的语音数据上训练,达到接近人类水平的语音识别准确率和鲁棒性。

ChatGPT 只提供了五种不同的声音进行选择:Breeze、Ember、Cove、Juniper 和 Sky。

提高访问限制

  • 价格按1000个tokens计费,1个token约等于4个字符,所以1000个tokens约等于750个单词。

  • 输入和输出分别计费,输入价格一般低于输出价格。例如GPT-4输入为0.03美元/1000个tokens,输出为0.06美元/1000个tokens。

  • 不同模型价格不同,越大的模型价格越高。例如GPT-4价格比GPT-3.5 Turbo高出近10倍。

模型的使用分训练和预测两部分计费:

  • 训练阶段按训练数据量计训练tokens数,以训练tokens价格计费。

  • 预测阶段只按实际使用的输入和输出tokens计费。

图像生成定价主要参考分辨率和质量:

  • DALL-E 2 1024x1024图片为0.02美元,512x512为0.018美元。
  • DALL-E 3 1024x1024 标准质量图片为0.04美元,高清质量为0.08美元。

语音识别系统Whisper为0.006美元/分钟。

  • 免费额度限制,GPT-3.5 Turbo 每月有 50 万 tokens 的免费限制。
  • 账号限制,限制API使用额度。
  • 为每个用户设置流控,限制其每秒的请求数。
  • 检测异常请求模式,预防 API 的滥用。
  • 设置 IP 访问黑名单等安全限制措施。

更好的 GPTs

Sam Altman 在今年 11 月宣布的「GPTs 对所有 ChatGPT+ 订阅者开放」和首届开发者日上 OpenAI 宣布将推出的 GPT 商店,都是重要的里程碑。

GPTs面向所有plus用户使用

https://chat.openai.com/gpts/editor
输入主题,定制logo。
微调提示词,微调助理定位,语气,是否专业,法律范围等等,提示词整合微调出结果。
上传知识库,进行解析,结合提示词能力。
Actions Zapier 能整合5000+插件扩展能力。

期待2024年 GPT Store 上市,把GPT 付费应用整合了,更好服务用户。
https://gptstore.ai/gpts

更好的推理能力

推力能力对于知识类挺强的,通过模板使用重复编辑,继续生成想要结果,对于创作类更多摘要式的或者关键词,还有与上传文件解析能力结合继续加强。

对觉醒/行为程度的控制

日常使用过程中,已经可以避免AI 伦理和违规生成,今年Sam Altman 做了这方面很多努力,例如全球巡演,继续使用迭代,有个担心发版时候会有阶段版本无法固化AI伦理和合规能力。

视频处理/生成能力

原生GPT现在没有视频处理能力,要加上处理能力得去GPTs Action中找外部插件引用才能间接使用。

个性化定制

现在个性化定制,有三种方式,一种设置里面有自定义提示词,一种API 微调,一种运用GPTs模板化处理。

API 微调门槛还是有的,需要处理结果数据,在线微调GPT。
GPTs 方式挺好用,不会写代码的也能使用,傻瓜式创建,知识库有限制,还有解析能力限制,比如上传图片解析能力就比较弱。

更强的联网搜索能力

加强GPT联网能力,发现一个现象单独使用GPT-4 直接生成内容,内容比较详细,但是同样内容跳到联网搜索生成内容,就返回比较粗糙,这是因为联网整合能力还不够强大。

使用 OpenAI 登录

用oauth 协议三方登录,跟API付费能力结合,让OpenAI 用户可以实现到处登录,打通使用工具壁垒。
在这里插入图片描述

OpenAI 目前拥有超过 10 亿用户,也成为了历史上用户增长速度最快的产品。根据当前的统计数据,ChatGPT 当前拥有超过 1.8 亿用户,每周活跃用户数达到 1 亿。

开源

llama 2 大模型开源为国内大模型市场提供了指导方向,证明大模型开源一种趋势,并不会产生不好影响,可以考虑开源GPT 这是呼声特别高的。

国内大模型发展就指望着GPT 和 llama 2 。

结论

明年非常期待OpenAI 产品发布,促进世界技术发展,替代过时方式,释放人类的创意和创造力。

这篇关于OpenAI 2024年展望:Sam Altman愿望清单的深度解析的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/546413

相关文章

网页解析 lxml 库--实战

lxml库使用流程 lxml 是 Python 的第三方解析库,完全使用 Python 语言编写,它对 XPath表达式提供了良好的支 持,因此能够了高效地解析 HTML/XML 文档。本节讲解如何通过 lxml 库解析 HTML 文档。 pip install lxml lxm| 库提供了一个 etree 模块,该模块专门用来解析 HTML/XML 文档,下面来介绍一下 lxml 库

Ilya-AI分享的他在OpenAI学习到的15个提示工程技巧

Ilya(不是本人,claude AI)在社交媒体上分享了他在OpenAI学习到的15个Prompt撰写技巧。 以下是详细的内容: 提示精确化:在编写提示时,力求表达清晰准确。清楚地阐述任务需求和概念定义至关重要。例:不用"分析文本",而用"判断这段话的情感倾向:积极、消极还是中性"。 快速迭代:善于快速连续调整提示。熟练的提示工程师能够灵活地进行多轮优化。例:从"总结文章"到"用

2024年流动式起重机司机证模拟考试题库及流动式起重机司机理论考试试题

题库来源:安全生产模拟考试一点通公众号小程序 2024年流动式起重机司机证模拟考试题库及流动式起重机司机理论考试试题是由安全生产模拟考试一点通提供,流动式起重机司机证模拟考试题库是根据流动式起重机司机最新版教材,流动式起重机司机大纲整理而成(含2024年流动式起重机司机证模拟考试题库及流动式起重机司机理论考试试题参考答案和部分工种参考解析),掌握本资料和学校方法,考试容易。流动式起重机司机考试技

【专题】2024飞行汽车技术全景报告合集PDF分享(附原数据表)

原文链接: https://tecdat.cn/?p=37628 6月16日,小鹏汇天旅航者X2在北京大兴国际机场临空经济区完成首飞,这也是小鹏汇天的产品在京津冀地区进行的首次飞行。小鹏汇天方面还表示,公司准备量产,并计划今年四季度开启预售小鹏汇天分体式飞行汽车,探索分体式飞行汽车城际通勤。阅读原文,获取专题报告合集全文,解锁文末271份飞行汽车相关行业研究报告。 据悉,业内人士对飞行汽车行业

【C++】_list常用方法解析及模拟实现

相信自己的力量,只要对自己始终保持信心,尽自己最大努力去完成任何事,就算事情最终结果是失败了,努力了也不留遗憾。💓💓💓 目录   ✨说在前面 🍋知识点一:什么是list? •🌰1.list的定义 •🌰2.list的基本特性 •🌰3.常用接口介绍 🍋知识点二:list常用接口 •🌰1.默认成员函数 🔥构造函数(⭐) 🔥析构函数 •🌰2.list对象

高效录音转文字:2024年四大工具精选!

在快节奏的工作生活中,能够快速将录音转换成文字是一项非常实用的能力。特别是在需要记录会议纪要、讲座内容或者是采访素材的时候,一款优秀的在线录音转文字工具能派上大用场。以下推荐几个好用的录音转文字工具! 365在线转文字 直达链接:https://www.pdf365.cn/ 365在线转文字是一款提供在线录音转文字服务的工具,它以其高效、便捷的特点受到用户的青睐。用户无需下载安装任何软件,只

2024网安周今日开幕,亚信安全亮相30城

2024年国家网络安全宣传周今天在广州拉开帷幕。今年网安周继续以“网络安全为人民,网络安全靠人民”为主题。2024年国家网络安全宣传周涵盖了1场开幕式、1场高峰论坛、5个重要活动、15场分论坛/座谈会/闭门会、6个主题日活动和网络安全“六进”活动。亚信安全出席2024年国家网络安全宣传周开幕式和主论坛,并将通过线下宣讲、创意科普、成果展示等多种形式,让广大民众看得懂、记得住安全知识,同时还

基于UE5和ROS2的激光雷达+深度RGBD相机小车的仿真指南(五):Blender锥桶建模

前言 本系列教程旨在使用UE5配置一个具备激光雷达+深度摄像机的仿真小车,并使用通过跨平台的方式进行ROS2和UE5仿真的通讯,达到小车自主导航的目的。本教程默认有ROS2导航及其gazebo仿真相关方面基础,Nav2相关的学习教程可以参考本人的其他博客Nav2代价地图实现和原理–Nav2源码解读之CostMap2D(上)-CSDN博客往期教程: 第一期:基于UE5和ROS2的激光雷达+深度RG

韦季李输入法_输入法和鼠标的深度融合

在数字化输入的新纪元,传统键盘输入方式正悄然进化。以往,面对实体键盘,我们常需目光游离于屏幕与键盘之间,以确认指尖下的精准位置。而屏幕键盘虽直观可见,却常因占据屏幕空间,迫使我们在操作与视野间做出妥协,频繁调整布局以兼顾输入与界面浏览。 幸而,韦季李输入法的横空出世,彻底颠覆了这一现状。它不仅对输入界面进行了革命性的重构,更巧妙地将鼠标这一传统外设融入其中,开创了一种前所未有的交互体验。 想象

2024/9/8 c++ smart

1.通过自己编写的class来实现unique_ptr指针的功能 #include <iostream> using namespace std; template<class T> class unique_ptr { public:         //无参构造函数         unique_ptr();         //有参构造函数         unique_ptr(