AI大模型日报#0606:智谱AI开源GLM-4-9B、Pika再融5.8亿

2024-06-06 22:44

本文主要是介绍AI大模型日报#0606:智谱AI开源GLM-4-9B、Pika再融5.8亿,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

导读:AI大模型日报,爬虫+LLM自动生成,一文览尽每日AI大模型要点资讯!

目前采用“文心一言”(ERNIE 4.0)、“零一万物”(Yi-Large)生成了今日要点以及每条资讯的摘要。欢迎阅读!

《AI大模型日报》今日要点:智谱AI近日发布了新一代开源语言模型GLM-4-9B,以其强大的推理性能、多模态处理能力及对多种语言的支持受到关注。该模型使用FP8技术提升训练效率,并在中文对齐、指令遵从等方面有显著进步。与此同时,Stability AI推出名为Stable Audio Open的音频生成模型,能生成长达47秒的高质量音频,为音乐制作和声音设计领域带来新工具,尽管其在逼真声音生成等方面仍存局限。 在AI创业方面,李沐携其大模型成果Higgs-Llama-3-70B回归B站,该模型专为复杂场景角色扮演设计,在多项基准测试中表现突出。此外,斯坦福华人博士创立的Pika宣布再融5.8亿,其自研的AI视频生成模型受到市场青睐,体现了AI视频生成赛道的投资与技术热度。 在学术研究领域,牛津大学与谷歌研究院联合开发的“CLIP as RNN”技术入选CVPR,该技术无需训练即可分割图像中的无数概念,为图像分割带来革命性进展。另一方面,马毅教授团队的CRATE-α模型通过数学推导设计每一层,提升了Transformer架构的可解释性和性能,展示了其可扩展性。 在AI应用层面,Paige开放全球最大病理学和肿瘤学AI模型使用权,阿里巴巴与世卫组织合作推广AI癌症筛查,腾讯则利用AI技术破解甲骨文之谜,推出了相关的平台和小程序,彰显了AI在多个领域的广泛应用潜力。

标题: GLM-4-9B 开源,探索模型极限
摘要: 智谱AI发布了新一代开源语言模型GLM-4-9B,该模型在预训练中使用了FP8技术,训练效率提升3.5倍,数据量是前代模型的3倍以上。GLM-4-9B具备更强的推理性能、更长的上下文处理能力、多语言、多模态和All Tools等功能。模型包括基础版本、对话版本、超长上下文版本和多模态版本。GLM-4-9B在中文对齐能力、指令遵从、工程代码等方面有显著提升,支持26种语言,并能处理长达1M tokens的文本。此外,模型还具备强大的函数调用和多模态处理能力,可智能调用外部工具和处理图像输入。
网址: GLM-4-9B 开源,探索模型极限|调用|模态|glm|预训练|上下文_网易订阅
 
标题: Stability AI开源47秒音频生成模型,虫鸣鸟叫、摇滚、鼓点都能生成
 


摘要: 科技记者报道: Stability AI 推出名为 Stable Audio Open 的开放模型,该模型可生成高质量音频数据。与商业版 Stable Audio 不同,Stable Audio Open 能通过文本提示生成长达47秒的音频。它擅长制作鼓点、乐器片段、环境音等,适合音乐制作和声音设计。用户可根据自定义音频数据对模型进行微调。该模型基于Transformer架构,由自编码器、文本嵌入和扩散模型组成。训练数据来自FreeSound和Free Music Archive,确保无版权问题。尽管Stable Audio Open 1.0在音频生成方面表现出色,但存在局限性,如无法生成逼真声音、对非英语描述支持有限、音乐风格多样性不足等。此外,该模型并非开源,且不能用于商业用途。
网址: Stability AI开源47秒音频生成模型,虫鸣鸟叫、摇滚、鼓点都能生成 | 机器之心
 
标题: 李沐老师回归B站!带着大模型创业成果填坑来了
 


摘要: 科技记者简讯: 李沐,AI领域知名学者,宣布回归B站并带来其大模型创业成果——Higgs-Llama-3-70B。该模型专为复杂场景角色扮演设计,基于Llama 3打造,并进行了完整的SFT、RLHF训练。在角色扮演任务和通用领域指令遵循、推理方面表现出色。Higgs-Llama-3-70B在MMLU-Pro和Arena-hard基准测试中展现了优于其他模型的能力,包括Claude3和Gemini。尽管与GPT-4o仍有差距,但团队强调并未针对性刷榜,并计划发布更多Higgs系列模型。李沐的创业公司Boson AI致力于利用AI技术为企业赋能,开发Agent以扮演多种角色,如游戏角色、语言教师等。团队成员包括李沐、Alex Smola等资深AI专家。公司已获得知名技术创业者投资,未来将进一步探索角色扮演性能、训练后的处理流程等策略。
网址: 李沐老师回归B站!带着大模型创业成果填坑来了 | 量子位
 
标题: 郭文景Pika再融5.8亿,最新估值约34亿,已自研AI视频生成基础模型
 


摘要: 科技记者报道: Pika,一家由斯坦福华人博士创立的AI视频生成初创公司,近日宣布完成新一轮8000万美元融资,估值达到4.7亿美元。投资者包括Spark Capital(领投)、Lightspeed和Greycrof等知名机构。Pika自研AI视频生成基础模型,产品1.0去年底发布,半年内团队从4人扩张至13人,并上线了多项新功能。AI视频生成赛道今年迎来技术与投资的双重爆发,Pika等初创公司正快速扩张,利用OpenAI和谷歌视频工具尚未公开的机会窗口。
网址: 郭文景Pika再融5.8亿,最新估值约34亿,已自研AI视频生成基础模型 | 量子位
 
标题: CLIP当RNN用入选CVPR:无需训练即可分割无数概念|牛津大学&谷歌研究院
 


摘要: 科技记者报道: 在图像分割领域,牛津大学和谷歌研究院的联合团队开发了一种名为“CLIP as RNN”(CaR)的新技术,该技术允许无需额外训练即可有效分割图像中的无数概念。这项成果已被CVPR 2024接收,并开源了代码。CaR技术解决了开放词汇量图像分割的几个关键问题,包括无需训练数据、保留预训练视觉-语言模型的广泛词汇空间以及对非图像中概念的文本查询处理。该技术通过迭代过程逐步优化,提高了分割质量,并通过循环调用CLIP模型,实现了高质量的开放词汇分割。
网址: CLIP当RNN用入选CVPR:无需训练即可分割无数概念|牛津大学&谷歌研究院 | 量子位
 
标题: 首次证实白盒Transformer可扩展性!马毅教授CRATE-α:鲸吞14亿数据,性能稳步提升
 


摘要: Transformer架构在AI领域取得了显著成就,但其设计缺乏严格的数学解释。马毅教授团队发布的CRATE模型通过数学推导设计每一层,提供可解释性。最近,加州大学研究团队提出CRATE-α,探索不同规模CRATE在视觉任务中的性能,并通过策略性修改提高可扩展性。CRATE-α在ImageNet分类任务上表现优于传统CRATE,且可解释性得到提升。研究还展示了CRATE-α的可扩展性,以及在资源有限情况下通过精心设计的预训练和微调策略扩展模型的有效性。项目链接:https://rayjryang.github.io/CRATE-alpha/。论文链接:https://arxiv.org/pdf/2405.20299。
网址: 首次证实白盒Transformer可扩展性!马毅教授CRATE-α:鲸吞14亿数据,性能稳步提升|马毅|研究人员_新浪新闻
 
标题: 全球最大病理学和肿瘤学多模态模型开放使用权;阿里达摩院与世卫组织推广AI癌症筛查;腾讯发布甲骨文AI协同平台:可映射到现代汉字
 


摘要: AI for Science企业动态速览: - Paige推出针对药物开发的AI服务,提供全球最大病理学和肿瘤学AI模型使用权。 - 阿里巴巴与世卫组织合作,推广达摩院AI癌症筛查技术。 - 谷歌与日本签署太阳能供电协议,为数据中心供电。 - Atropos Health完成3300万美元融资,进军药物研发。 - 中国气象局发布AI气象预报大模型示范计划。 - 腾讯用AI破解甲骨文之谜,推出“殷契文渊”平台和“了不起的甲骨文”小程序。
网址: 全球最大病理学和肿瘤学多模态模型开放使用权;阿里达摩院与世卫组织推广AI癌症筛查;腾讯发布甲骨文AI协同平台:可映射到现代汉字 - 智源社区
 

这篇关于AI大模型日报#0606:智谱AI开源GLM-4-9B、Pika再融5.8亿的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1037447

相关文章

揭秘未来艺术:AI绘画工具全面介绍

📑前言 随着科技的飞速发展,人工智能(AI)已经逐渐渗透到我们生活的方方面面。在艺术创作领域,AI技术同样展现出了其独特的魅力。今天,我们就来一起探索这个神秘而引人入胜的领域,深入了解AI绘画工具的奥秘及其为艺术创作带来的革命性变革。 一、AI绘画工具的崛起 1.1 颠覆传统绘画模式 在过去,绘画是艺术家们通过手中的画笔,蘸取颜料,在画布上自由挥洒的创造性过程。然而,随着AI绘画工

一份LLM资源清单围观技术大佬的日常;手把手教你在美国搭建「百万卡」AI数据中心;为啥大模型做不好简单的数学计算? | ShowMeAI日报

👀日报&周刊合集 | 🎡ShowMeAI官网 | 🧡 点赞关注评论拜托啦! 1. 为啥大模型做不好简单的数学计算?从大模型高考数学成绩不及格说起 司南评测体系 OpenCompass 选取 7 个大模型 (6 个开源模型+ GPT-4o),组织参与了 2024 年高考「新课标I卷」的语文、数学、英语考试,然后由经验丰富的判卷老师评判得分。 结果如上图所

AI儿童绘本创作

之前分享过AI儿童绘画的项目,但是主要问题是角色一致要花费很长的时间! 今天发现了这款,非常奈斯! 只需输入故事主题、风格、模板,软件就会自动创作故事内容,自动生成插画配图,自动根据模板生成成品,测试效果如下图。 变现方式:生成儿童绘本发布到各平台,吸引宝妈群体进私域。  百度网盘 请输入提取码百度网盘为您提供文件的网络备份、同步和分享服务。空间大、速度快、安全

大语言模型(LLMs)能够进行推理和规划吗?

大语言模型(LLMs),基本上是经过强化训练的 n-gram 模型,它们在网络规模的语言语料库(实际上,可以说是我们文明的知识库)上进行了训练,展现出了一种超乎预期的语言行为,引发了我们的广泛关注。从训练和操作的角度来看,LLMs 可以被认为是一种巨大的、非真实的记忆库,相当于为我们所有人提供了一个外部的系统 1(见图 1)。然而,它们表面上的多功能性让许多研究者好奇,这些模型是否也能在通常需要系

人工和AI大语言模型成本对比 ai语音模型

这里既有AI,又有生活大道理,无数渺小的思考填满了一生。 上一专题搭建了一套GMM-HMM系统,来识别连续0123456789的英文语音。 但若不是仅针对数字,而是所有普通词汇,可能达到十几万个词,解码过程将非常复杂,识别结果组合太多,识别结果不会理想。因此只有声学模型是完全不够的,需要引入语言模型来约束识别结果。让“今天天气很好”的概率高于“今天天汽很好”的概率,得到声学模型概率高,又符合表达

智能客服到个人助理,国内AI大模型如何改变我们的生活?

引言 随着人工智能(AI)技术的高速发展,AI大模型越来越多地出现在我们的日常生活和工作中。国内的AI大模型在过去几年里取得了显著的进展,不少独创的技术点和实际应用令人瞩目。 那么,国内的AI大模型有哪些独创的技术点?它们在实际应用中又有哪些出色表现呢?此外,普通人又该如何利用这些大模型提升工作和生活的质量和效率呢?本文将为你一一解析。 一、国内AI大模型的独创技术点 多模态学习 多

探索Elastic Search:强大的开源搜索引擎,详解及使用

🎬 鸽芷咕:个人主页  🔥 个人专栏: 《C++干货基地》《粉丝福利》 ⛺️生活的理想,就是为了理想的生活! 引入 全文搜索属于最常见的需求,开源的 Elasticsearch (以下简称 Elastic)是目前全文搜索引擎的首选,相信大家多多少少的都听说过它。它可以快速地储存、搜索和分析海量数据。就连维基百科、Stack Overflow、

【新闻】AI程序员要来了吗?阿里云官宣

内容提要 6 月 21 日,在阿里云上海 AI 峰会上,阿里云宣布推出首个AI 程序员。 据介绍,这个AI程序员具备架构师、开发工程师、测试工程师等多种岗位的技能,能一站式自主完成任务分解、代码编写、测试、问题修复、代码提交整个过程,最快分钟级即可完成应用开发,大幅提升研发效率。 近段时间以来,有关AI的实践应用突破不断,全球开发者加速研发步伐。有业内人士坦言,随着大模型性能逐渐提升,AI应

OpenCompass:大模型测评工具

大模型相关目录 大模型,包括部署微调prompt/Agent应用开发、知识库增强、数据库增强、知识图谱增强、自然语言处理、多模态等大模型应用开发内容 从0起步,扬帆起航。 大模型应用向开发路径:AI代理工作流大模型应用开发实用开源项目汇总大模型问答项目问答性能评估方法大模型数据侧总结大模型token等基本概念及参数和内存的关系大模型应用开发-华为大模型生态规划从零开始的LLaMA-Factor

模型压缩综述

https://www.cnblogs.com/shixiangwan/p/9015010.html