OpenAI 文本转视频大模型 Sora 引爆科技圈!人类离 AGI 真的不远了吗?

2024-02-23 19:12

本文主要是介绍OpenAI 文本转视频大模型 Sora 引爆科技圈!人类离 AGI 真的不远了吗?,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

一年前 AI 智能涌现的场景又重现。

2 月 16 日,OpenAI 发布了最新的视频生成模型 Sora。它能够根据用户输入的提示词、文本指令或静态图像,生成长达一分钟的视频。

这一举动无疑轰动了整个科技圈,从目前 Open AI 展示的信息来看,Sora 实现了 AIGC 领域的里程碑式进展。从仅通过输入一句话,生成文本,再到图片,到现在可生成与好莱坞画面相媲美的视频,且长度最多可达 1 分钟,这让不少科技大佬折服。

Sora 到底有多强?

在官网更新的 48 个视频中,Sora 不仅能准确呈现细节,还可以根据提示、静止图像填补现有视频中的缺失帧来生成视频。其中既能实现多角度镜头的自然切换,还包含复杂的场景和生动的角色表情,且故事的逻辑性和连贯性极佳。

来看看官网更新的其中一个文本生成的视频:

AI 文本提示:一位时尚的女人走在东京的街道上,街道上到处都是温暖的发光霓虹灯和动画城市标志。她身穿黑色皮夹克,红色长裙,黑色靴子,背着一个黑色钱包。她戴着墨镜,涂着红色口红。她自信而随意地走路。街道潮湿而反光,营造出五颜六色的灯光的镜面效果。许多行人四处走动。

在这段仅持续一分钟的视频里,一位穿着鲜艳红裙的女士漫步在繁华都市、五光十色的霓虹灯下。视频的呈现风格极为逼真,画面切换自然流畅,但最令人震惊的,无疑是女主角那细致入微的面部特写。从毛孔的细微张开,到斑点与痘印的真实展现,每一个皮肤细节都栩栩如生,仿佛我们能直接触摸到她的肌肤质感。而那种粉底微脱、妆容稍许不整的效果,显得更加真实!

除了对人物写实,Sora 还能够模拟现实中的动物与环境以及非写实的创意动画等等,其生成效果让网友开始担心起了各行业人士的饭碗。

Sora 的技术原理其实跟 ChatGPT 类似,都是拼接大量的数据和训练,建立起大模型,然后利用强大的算力快速生成内容。

目前主流大模型都是建立在巨大的参数量和运算量之上的,对算力提出了极高的要求,Sora 的横空出世,推动算力需求的持续高涨。训练一个模型需要大量 GPU 服务器。

为了提高企业 AI 应用产品的健康快速落地,支撑企业低成本快速使用 AI 算力资源。Finovy Cloud 提供全球先进算力产品和服务引擎,高性能云主机,致力于为企业提供先进的 AI 算力,助企业在 AI 行业中获得发展红利,协力迎接一个更加高效、智能的 AI 新时代到来。

这篇关于OpenAI 文本转视频大模型 Sora 引爆科技圈!人类离 AGI 真的不远了吗?的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/739650

相关文章

Golang的CSP模型简介(最新推荐)

《Golang的CSP模型简介(最新推荐)》Golang采用了CSP(CommunicatingSequentialProcesses,通信顺序进程)并发模型,通过goroutine和channe... 目录前言一、介绍1. 什么是 CSP 模型2. Goroutine3. Channel4. Channe

Python视频处理库VidGear使用小结

《Python视频处理库VidGear使用小结》VidGear是一个高性能的Python视频处理库,本文主要介绍了Python视频处理库VidGear使用小结,文中通过示例代码介绍的非常详细,对大家的... 目录一、VidGear的安装二、VidGear的主要功能三、VidGear的使用示例四、VidGea

通过C#获取PDF中指定文本或所有文本的字体信息

《通过C#获取PDF中指定文本或所有文本的字体信息》在设计和出版行业中,字体的选择和使用对最终作品的质量有着重要影响,然而,有时我们可能会遇到包含未知字体的PDF文件,这使得我们无法准确地复制或修改文... 目录引言C# 获取PDF中指定文本的字体信息C# 获取PDF文档中用到的所有字体信息引言在设计和出

Python基于火山引擎豆包大模型搭建QQ机器人详细教程(2024年最新)

《Python基于火山引擎豆包大模型搭建QQ机器人详细教程(2024年最新)》:本文主要介绍Python基于火山引擎豆包大模型搭建QQ机器人详细的相关资料,包括开通模型、配置APIKEY鉴权和SD... 目录豆包大模型概述开通模型付费安装 SDK 环境配置 API KEY 鉴权Ark 模型接口Prompt

Java操作xls替换文本或图片的功能实现

《Java操作xls替换文本或图片的功能实现》这篇文章主要给大家介绍了关于Java操作xls替换文本或图片功能实现的相关资料,文中通过示例代码讲解了文件上传、文件处理和Excel文件生成,需要的朋友可... 目录准备xls模板文件:template.xls准备需要替换的图片和数据功能实现包声明与导入类声明与

python解析HTML并提取span标签中的文本

《python解析HTML并提取span标签中的文本》在网页开发和数据抓取过程中,我们经常需要从HTML页面中提取信息,尤其是span元素中的文本,span标签是一个行内元素,通常用于包装一小段文本或... 目录一、安装相关依赖二、html 页面结构三、使用 BeautifulSoup javascript

Ilya-AI分享的他在OpenAI学习到的15个提示工程技巧

Ilya(不是本人,claude AI)在社交媒体上分享了他在OpenAI学习到的15个Prompt撰写技巧。 以下是详细的内容: 提示精确化:在编写提示时,力求表达清晰准确。清楚地阐述任务需求和概念定义至关重要。例:不用"分析文本",而用"判断这段话的情感倾向:积极、消极还是中性"。 快速迭代:善于快速连续调整提示。熟练的提示工程师能够灵活地进行多轮优化。例:从"总结文章"到"用

流媒体平台/视频监控/安防视频汇聚EasyCVR播放暂停后视频画面黑屏是什么原因?

视频智能分析/视频监控/安防监控综合管理系统EasyCVR视频汇聚融合平台,是TSINGSEE青犀视频垂直深耕音视频流媒体技术、AI智能技术领域的杰出成果。该平台以其强大的视频处理、汇聚与融合能力,在构建全栈视频监控系统中展现出了独特的优势。视频监控管理系统EasyCVR平台内置了强大的视频解码、转码、压缩等技术,能够处理多种视频流格式,并以多种格式(RTMP、RTSP、HTTP-FLV、WebS

大模型研发全揭秘:客服工单数据标注的完整攻略

在人工智能(AI)领域,数据标注是模型训练过程中至关重要的一步。无论你是新手还是有经验的从业者,掌握数据标注的技术细节和常见问题的解决方案都能为你的AI项目增添不少价值。在电信运营商的客服系统中,工单数据是客户问题和解决方案的重要记录。通过对这些工单数据进行有效标注,不仅能够帮助提升客服自动化系统的智能化水平,还能优化客户服务流程,提高客户满意度。本文将详细介绍如何在电信运营商客服工单的背景下进行

Andrej Karpathy最新采访:认知核心模型10亿参数就够了,AI会打破教育不公的僵局

夕小瑶科技说 原创  作者 | 海野 AI圈子的红人,AI大神Andrej Karpathy,曾是OpenAI联合创始人之一,特斯拉AI总监。上一次的动态是官宣创办一家名为 Eureka Labs 的人工智能+教育公司 ,宣布将长期致力于AI原生教育。 近日,Andrej Karpathy接受了No Priors(投资博客)的采访,与硅谷知名投资人 Sara Guo 和 Elad G