Learn more about Technology - Section 26
认识ChatArena 一个Python库,旨在促进多个大型语言模型(LLMs)之间的通信和协作
ChatArena是一个Python软件包,旨在帮助各种巨型语言模型协同工作。ChatArena已经包含了一个多智能体对话模拟环境。参与者的...
AI-设计的药物已经准备好进行人体试验
由中国复星集团和私募巨头华平投资支持的生物科技公司 Insilico Medicine,已经开始了一项完全由人工智能 (AI) 发现和设计的...
斯坦福研究人员推出SequenceMatch:使用模仿学习损失训练LLMs
自回归模型是一类基于变量当前值高度依赖于其过去值的统计模型。换句话说,该模型通过将变量回归其过去值来预测变量的未来值...
普林斯顿的研究人员推出Infinigen:一种自然界照片级3D场景的程序生成器
普林斯顿大学的研究团队在最近的一篇论文中介绍了 Infinigen,这是一款划时代的程序生成器,可用于生成逼真的三维场景,论文...
来自 Allen Institute for AI 的研究人员介绍了 VISPROG:一种神经符号化方法,用于根据自然语言指令解决复杂和组合的视觉任务
寻找通用人工智能系统推动了具备能力的可训练模型的发展,其中许多旨在为用户提供简单的自然语言接口。大规模无监督预训练后...
如何使用Folium生成交互地图
Folium 是一个使用 Leaflet.js 和 Open Street Map 数据创建高质量地图可视化的 Python 库
深度学习在推荐系统中的应用:入门指南
推荐系统是当今发展最快的工业机器学习应用之一从商业角度来看,这并不令人惊讶:更好的推荐可以带来更多的用户...
认识Video-ControlNet:一款新的游戏改变型文本到视频扩散模型,塑造可控视频生成的未来
近年来,基于文本的视觉内容生成得到了快速发展。通过大规模的图像-文本对进行训练,目前的文本到图像(T2I)扩散模型已经展...
UC Berkeley和Meta AI研究人员提出了一种拉格朗日动作识别模型,通过融合3D姿态和上下文化外观来跟踪轨迹
在流体力学中,惯性系和欧拉系的流场表示是惯例。根据维基百科,“流场的拉格朗日描述是一种研究流体运动的方法,其中观察者跟...
多模态人工智能:能够看和听的人工智能
自从人工智能 (AI) 诞生以来, 它已经取得了长足的发展, 但直到最近, 它的能力仅限于基于文本的通信和有限的世界知识。然而, ...
认识CoDi:一种新的跨模态扩散模型,可用于任意合成
在过去的几年中,出现了一些强大的交叉模态模型,能够从一种信息中生成另一种信息,例如将文本转换为文本、图像或音频。一个...
来自 Meta AI 和 Samsung 的研究人员介绍了两种新的 AI 方法,Prodigy 和 Resetting,用于学习速率适应,这些方法改进了现有最先进的 D-适应方法的适应速率
现代机器学习在计算机视觉、自然语言处理和强化学习等领域中,很大程度上依赖于优化来提供有效的答案。快速收敛和高质量解的...
来自萨里大学的研究人员推出了一款基于素描的机器学习物体检测工具,具有颠覆性的影响
自史前时代起,人们就用草图进行交流和文件记录。在过去的十年中,研究人员在理解如何使用草图从分类和合成到更新颖的应用,...
机器狗以 MJ 风格跳月步:这项 AI 研究提出使用以代码表示的奖励作为 LLM 与基于优化的动作控制器之间灵活的接口
近年来,人工智能行业已经占据了世界。几乎每天都有新的独特研究和模型发布,AI正在不断发展和变得更加优秀。无论我们考虑医...
世界首个AI动力臂:您需要知道的一切
你有没有想象过一个人工智能可以控制仿生手臂的世界?虽然听起来像是超级英雄电影中的概念,但现在对于一个非凡的女性来说,...
Voxel51开源VoxelGPT:一种利用GPT-3.5的能力生成Python代码进行计算机视觉数据集分析的AI助手
Voxel51是数据中心计算机视觉和机器学习软件领域的杰出创新者之一,最近推出了计算机视觉领域的一个重大突破,推出了VoxelGPT...
来自马里兰大学学院市分校的最新人工智能研究开发出了一种人工智能系统,可以从人眼中的反射中重建三维场景
人眼是一种奇妙的器官,允许视觉并存储重要的环境数据。它们通常将它们的眼睛用作两个镜头,以将光线引导到组成视网膜的感光...
从声音到视觉:了解用于音频到图像合成的AudioToken
神经生成模型改变了我们消费数字内容的方式,彻底改变了各个方面。它们具有生成高质量图像的能力,确保长篇文本的连贯性,甚...
新兴能力揭示:只有成熟的AI像GPT-4才能自我改进吗?探索语言模型自主增长的影响
研究人员正在调查,类似于AlphaGo Zero,其中AI代理通过反复参与具有明确规则的竞争游戏来发展自己,许多大型语言模型(LLM)...
了解CapPa:DeepMind的创新图像字幕策略,正在改变视觉预训练并与CLIP在可扩展性和学习性能方面展开竞争
一篇最近的论文,名为“图像字幕生成器也是可扩展的视觉学习者”,提出了一种有趣的方法,称为CapPa,旨在将图像字幕生成作为视...
- You may be interested
- 来自微软研究院和清华大学的研究人员提出...
- “遇见PhysObjects:一个基于物体的数据集...
- 「MAXimum AI性能:NVIDIA GPU加速的最新A...
- 别名:你的时间序列在欺骗你
- 开始使用AI/ML构建智能供应链
- 促使工程师在大型语言模型中利用上下文学习
- 亚马逊的新机器人正在推动自动化革命
- Taplio 领英增长的最佳AI工具
- 这篇人工智能论文提供了机器学习流程中各...
- Atom Computing首次宣布推出一台拥有1000...
- “捕捉碳”
- 我的生活统计:我追踪了一年的习惯,这是...
- 新兴初创公司参加人工智能会议的优势
- 为什么 AI 已成为 2023 年最重要的开发者技能
- 使用Hugging Face的Transformer模型构建评...