Redian新闻
>
发布屡次截胡?OpenAI与谷歌携新版大模型再度交锋 | 大模型一周大事

发布屡次截胡?OpenAI与谷歌携新版大模型再度交锋 | 大模型一周大事

公众号新闻
大模型的快节奏发展,让了解最新技术动态、积极主动学习成为每一位从业者的必修课。InfoQ 研究中心期望通过每周更新大模型行业最新动态,为广大读者提供全面的行业回顾和要点分析。现在,让我们回顾过去一周的大模型重大事件吧。
一、重点发现

本周,人工智能领域迎来了一波大模型发布的高潮,行业玩家纷纷推出自家的创新成果,AI 巨头间的角力再次升温。OpenAI、谷歌、百度和腾讯等公司相继亮相了各自的大模型。其中,OpenAI 的新一代模型 GPT-4o 与谷歌的 Gemini 家族最为引人注目。新模型不仅在多模态理解能力、长文本理解、运行速度等性能上有所突破,更在应用场景和用户体验上带来了新的想象空间,预示着 AI 技术将在未来扮演更加关键的角色。

二、具体内容
大模型持续更新
  1. 5 月 12 日,斯坦福大学的研究者开发了一个名为 ThunderKittens 的 AI 加速框架。该框架通过简化的 CUDA DSL 让开发者能够更容易地编写高效的 GPU 内核,显著提高了 GPU 利用率。ThunderKittens 在 RTX 4090 上实现了约 122 TFLOP 的性能,且在 H100 上的性能比 FlashAttention-2 高出约 30%。

  2. 5 月 14 日,OpenAI 发布了新一代模型 GPT-4o ,这是一个全能模型。该模型集成了文本、语音、图像三种模态的理解力,能够实时生成文本、音频和图像的输出。GPT-4o 在英语文本、代码、非英语文本、视觉和音频理解方面都有显著提升。

  3. 5 月 15 日,谷歌发布 Gemini 家族新成员 Gemini 1.5 Flash ,并宣布更新 Gemini 1.5 Pro 。Gemini 1.5 Flash 是一款专为速度而优化的小型模型,旨在处理高频任务,提供快速响应。它能够分析和处理包括文本、图片和视频在内的多种信息类型,拥有高达 100 万个 Token 的处理能力。Gemini 1.5 Pro  具备 200 万 token 的超长上下文窗口,能够处理大量信息,如 2 小时视频、 22 小时音频、超过 6 万行代码或 140 多万单词。

  4. 5 月 15 日,百度发布了全球首个 L4 级自动驾驶大模型 Apollo ADFM ,并宣称其安全性是普通人类驾驶员的 10 倍以上,能覆盖城市级全域复杂场景。

  5. 5 月 16 日,亚信科技认知增强平台 TAC MaaS 与渊思·编程大模型、渊思·自智网络大模型、渊思·智能运维大模型 3 个行业大模型。

  6. 5 月 17 日,腾讯云正式发布教育行业大模型。该模型基于自研混元大模型,融合了教材、习题、论文等资源,并通过腾讯云 TI 平台优化,特别在中文阅读理解、问答和教育相关任务上表现优异。

  7. 5 月 17 日,字节跳动发布了豆包大模型(原云雀大模型) AI 产品家族。豆包大模型家族包括九款模型,满足不同场景需求,并且字节跳动还推出了 AI 应用产品“扣子”和豆包 App 。

开源领域
  1. 5 月 13 日,零一万物发布了其 Yi 大模型家族的新成员 Yi-1.5 并正式开源。Yi-1.5 包含 6B、9B、34B 三个版本的预训练和微调模型,采用 Apache 2.0 许可证。作为 Yi-1.0 的持续预训练版本, Yi-1.5 在 500 B 个 token 上进行了训练,以提升编码、推理和指令执行能力,并在 300 万个指令调优样本上进行了精细调整。

  2. 5 月 14 日,腾讯宣布其混元文生图大模型全面开源。该模型支持中英文双语输入及理解,拥有 15 亿参数量,并采用了与 Sora 一致的 DiT(Diffusion With Transformer) 架构,使其在文生图生成方面表现优异,效果超越开源的 Stable Diffusion 模型。

多模态领域
  1. 5 月 15 日,谷歌发布了视频生成模型 Veo ,该模型能够根据文本提示生成超过 60 秒的高质量 1080p 视频,支持多种电影风格,并具备深层次的语言与视觉理解能力。Veo 能够准确捕捉文本中的细微差别,并在视频场景中逼真呈现细节。

科研领域
  1. 5 月 13 日,百度大数据实验室与上海交通大学团队合作开发了名为 RNAErnie 的基于 Transformer 的 RNA 语言模型。该模型通过基序感知预训练和类型引导的微调策略,在多个数据集和任务中表现出色,准确率和 F1 得分显著提高,证明了其在 RNA 序列分析方面的优越性和泛化潜力。

  2. 5 月 16 日,来自亚马逊与得克萨斯大学奥斯汀分校的研究团队发表论文《SynthesizRR: Generating Diverse Datasets with Retrieval Augmentation》。SynthesizRR 是一种创新的数据集合成技术,通过结合检索和精细化(Refinement)方法,解决了传统大型语言模型在生成示例时出现的重复性、偏差和风格差异问题。该技术通过引入多样化的内容“种子”,显著提升了词汇和语义的多样性,并在多个复杂任务的数据集上,与人类文本的相似性以及学生模型的提炼性能方面取得了显著进步。

应用探索
智能体
  1. 5 月 13 日,宇树科技推出了新款人形机器人 Unitree G1 ,其起步价为 9.9 万元人民币,相比之前推出的 Unitree H1 价格大幅下降。Unitree G1 身高 1.27 米,体重 35 公斤,具有多达 43 个关节电机(基础版为 23 个),能够模拟复杂动作并实现精细的运动控制。这款机器人可以折叠存放,运行速度可达 2 米 / 秒,并且配备了 3D LiDAR 传感器和深度摄像头,具备 360 度全景深度感知能力。

  2. 5 月 15 日,谷歌发布名为 Project Astra 的 AI Agent 。Project Astra 能够接收信息、记忆所看到的内容、处理信息并理解上下文细节,以实现与周围世界的自然交互。它在声音和视觉处理方面表现出色,能够进行无延迟的实时语音交互,并快速响应用户的问题,通过连续编码视频帧和组合视频、语音信息来处理收到的内容。

基础设施

5 月 15 日,谷歌发布第六代 AI 芯片 Trillium 。这款新型 TPU 在计算性能上实现了高达 4.7 倍的提升,同时内存带宽翻倍,能效比上一代产品提高了 67% 。Trillium 芯片采用了谷歌自研的第三代 SparseCore 技术,有效加速了模型训练并降低了服务延迟。预计 Trillium 将在今年年底向云客户提供,进一步巩固其在云计算和 AI 领域的领导地位。

报告推荐

AGI 概念引发热议。那么 AGI 究竟是什么?技术架构来看又包括哪些?AI Agent 如何助力人工智能走向 AGI 时代?现阶段营销、金融、教育、零售、企服等行业场景下,AGI 应用程度如何?有哪些典型应用案例了吗?以上问题的回答尽在《中国 AGI 市场发展研究报告 2024》,欢迎大家扫码关注「AI 前线」公众号,回复「AGI」领取。

报告预告

金融行业是否找到了大模型落地应用的最佳路径?取得了哪些具体应用成果? 又存在哪些难以逾越的挑战与桎梏?金融机构一定要应用大模型吗?如何考量金融大模型应用效果?欢迎大家持续关注 InfoQ 研究中心即将发布的《大模型在金融领域的应用洞察》。

活动推荐

AICon 全球金融科技大会将于 8 月 16 日正式开幕,本次大会主题为「科技驱动,智启未来——激发数字金融内生力」。如您感兴趣,可点击「阅读原文」查看更多详情。

咨询其他问题请联系票务同学:13269078023,或扫描上方二维码添加大会福利官,可领取福利资料包。


今日荐文


26岁带着百人团队冲刺大模型,面壁智能天才CTO:高效比参数更重要


AICon 2024 重磅开幕!60 余位大咖干货集结:20 年来云首次革命性变化、大模型才刚刚开始……


老便宜了!字节跳动豆包大模型开始营业,一元钱能买125万Tokens,月活用户量达2600万


OpenAI 官宣旗舰模型 GPT-4o,完全免费、无障碍与人交谈!奥特曼:这是我们最好的模型

你也「在看」吗?👇

微信扫码关注该文公众号作者

戳这里提交新闻线索和高质量文章给我们。
相关阅读
这个团队做了OpenAI没Open的技术,开源OpenRLHF让对齐大模型超简单双林奇案录第三部之校园疑案: 第三十节欧盟加大对AI巨头审查,OpenAI、微软与谷歌在列;上海市首个“AI陪诊师”正式上线丨AIGC日报让智能设备更懂你,主动式AI正在崛起 | 大模型一周大事Meta、微软、Mistral AI、Hugging Face、通义、港中文六路进发开源大模型 | 大模型一周大事蚂蚁百灵大模型一号位:GPT-4o发布不意外,原生多模态方向已明要求TD Synnex采纳简单多数可决原则的提案神秘大模型一夜“征服”所有人,超GPT-4却无人认领?网友:OpenAI 要有大麻烦了拜登要退选?OpenAI要和博通研发AI芯片,对抗英伟达!办公、代码赛道应用竞争白热化,音乐生成新贵 Suno 和 Udio 深陷侵权诉讼 | 大模型一周大事ChatGPT 语音模式酷似「寡姐」?OpenAI 刚刚发文回应神秘大模型一夜爆红!奥特曼亲自确认,疑似GPT-4.5发布国产版Sora到来!视频大模型更上一层楼 | 大模型一周大事华为回应智界 S7 截胡小米 SU7,雷军表态/苹果正在自研设备端大语言模型/「欧洲版OpenAI」洽谈融资5亿阿里云进军大模型一年,现在是开源第一名,CTO:闭源要超过所有开源模型才有机会参与讨论鲶鱼效应显著!Sora 发布满月,多模态领域成果丰硕 | 大模型一周大事Stability、Mistral、Databricks、通义、A21 Labs开源五连招,其中三个是MoE!|大模型一周大事AI教父背书,OpenAI与谷歌员工联合签署公开信,呼吁公司重视AI安全GPT-4.5/5 内测版回归?OpenAI 神秘新模型惊艳网友,另一个重磅更新即将上线三个清华校友,争抢大模型一哥超越OpenAI,谷歌重磅发布从大模型蒸馏的编码器Gecko奥特曼百万年薪挖角谷歌TPU人才,欲砸7万亿实现「芯片自由」?OpenAI自研芯片最新进展曝光上帝视角下的蓝天白云?大模型改变气象预测格局 | 大模型一周大事骚粉的EF车队今天夺冠AI视频技术突破静默,让每一帧画面实现声色同步 | 大模型一周大事OpenAI发布新旗舰模型GPT-4o;字节跳动正式发布豆包大模型|AIGC周观察第四十三期OpenAI否认加入的AI搜索已是一片红海!Stack Overflow 数据用于 AI 训练再次引发争议!| 大模型一周大事中东见闻6 多哈的海滨风景大模型的“瘦身”革命:巨头逐鹿轻量化大模型 | 大模型一周大事微软亚研院新作:让大模型一口气调用数百万个API!每天都看模型评分,但你真的了解吗?OpenAI研究员最新博客,一文读懂LLM评估双林奇案录第三部之校园疑案: 第三十一节逼员工签“封口协议”?OpenAI 脸都被打肿了。。。【今日天下0515】美国高中数学教育比国内难多了;有人现实中见过小三吗?OpenAI换掉了首席科学家;我眼中的宋博士Doge去世;小米汽车回应电池疑似反向虚标;马斯克与谷歌创始人前妻胡搞细节曝光
logo
联系我们隐私协议©2024 redian.news
Redian新闻
Redian.news刊载任何文章,不代表同意其说法或描述,仅为提供更多信息,也不构成任何建议。文章信息的合法性及真实性由其作者负责,与Redian.news及其运营公司无关。欢迎投稿,如发现稿件侵权,或作者不愿在本网发表文章,请版权拥有者通知本网处理。