Learn more about Technology - Section 26

认识ChatArena 一个Python库,旨在促进多个大型语言模型(LLMs)之间的通信和协作

ChatArena是一个Python软件包,旨在帮助各种巨型语言模型协同工作。ChatArena已经包含了一个多智能体对话模拟环境。参与者的...

AI-设计的药物已经准备好进行人体试验

由中国复星集团和私募巨头华平投资支持的生物科技公司 Insilico Medicine,已经开始了一项完全由人工智能 (AI) 发现和设计的...

斯坦福研究人员推出SequenceMatch:使用模仿学习损失训练LLMs

自回归模型是一类基于变量当前值高度依赖于其过去值的统计模型。换句话说,该模型通过将变量回归其过去值来预测变量的未来值...

普林斯顿的研究人员推出Infinigen:一种自然界照片级3D场景的程序生成器

普林斯顿大学的研究团队在最近的一篇论文中介绍了 Infinigen,这是一款划时代的程序生成器,可用于生成逼真的三维场景,论文...

来自 Allen Institute for AI 的研究人员介绍了 VISPROG:一种神经符号化方法,用于根据自然语言指令解决复杂和组合的视觉任务

寻找通用人工智能系统推动了具备能力的可训练模型的发展,其中许多旨在为用户提供简单的自然语言接口。大规模无监督预训练后...

如何使用Folium生成交互地图

Folium 是一个使用 Leaflet.js 和 Open Street Map 数据创建高质量地图可视化的 Python 库

深度学习在推荐系统中的应用:入门指南

推荐系统是当今发展最快的工业机器学习应用之一从商业角度来看,这并不令人惊讶:更好的推荐可以带来更多的用户...

认识Video-ControlNet:一款新的游戏改变型文本到视频扩散模型,塑造可控视频生成的未来

近年来,基于文本的视觉内容生成得到了快速发展。通过大规模的图像-文本对进行训练,目前的文本到图像(T2I)扩散模型已经展...

UC Berkeley和Meta AI研究人员提出了一种拉格朗日动作识别模型,通过融合3D姿态和上下文化外观来跟踪轨迹

在流体力学中,惯性系和欧拉系的流场表示是惯例。根据维基百科,“流场的拉格朗日描述是一种研究流体运动的方法,其中观察者跟...

多模态人工智能:能够看和听的人工智能

自从人工智能 (AI) 诞生以来, 它已经取得了长足的发展, 但直到最近, 它的能力仅限于基于文本的通信和有限的世界知识。然而, ...

认识CoDi:一种新的跨模态扩散模型,可用于任意合成

在过去的几年中,出现了一些强大的交叉模态模型,能够从一种信息中生成另一种信息,例如将文本转换为文本、图像或音频。一个...

来自萨里大学的研究人员推出了一款基于素描的机器学习物体检测工具,具有颠覆性的影响

自史前时代起,人们就用草图进行交流和文件记录。在过去的十年中,研究人员在理解如何使用草图从分类和合成到更新颖的应用,...

世界首个AI动力臂:您需要知道的一切

你有没有想象过一个人工智能可以控制仿生手臂的世界?虽然听起来像是超级英雄电影中的概念,但现在对于一个非凡的女性来说,...

来自马里兰大学学院市分校的最新人工智能研究开发出了一种人工智能系统,可以从人眼中的反射中重建三维场景

人眼是一种奇妙的器官,允许视觉并存储重要的环境数据。它们通常将它们的眼睛用作两个镜头,以将光线引导到组成视网膜的感光...

从声音到视觉:了解用于音频到图像合成的AudioToken

神经生成模型改变了我们消费数字内容的方式,彻底改变了各个方面。它们具有生成高质量图像的能力,确保长篇文本的连贯性,甚...

新兴能力揭示:只有成熟的AI像GPT-4才能自我改进吗?探索语言模型自主增长的影响

研究人员正在调查,类似于AlphaGo Zero,其中AI代理通过反复参与具有明确规则的竞争游戏来发展自己,许多大型语言模型(LLM)...

了解CapPa:DeepMind的创新图像字幕策略,正在改变视觉预训练并与CLIP在可扩展性和学习性能方面展开竞争

一篇最近的论文,名为“图像字幕生成器也是可扩展的视觉学习者”,提出了一种有趣的方法,称为CapPa,旨在将图像字幕生成作为视...