Learn more about Technology - Section 6
一项来自特拉维夫和哥本哈根大学的新的人工智能研究引入了一种“即插即用”的方法,通过使用辨别信号来快速微调文本到图像扩散模型
文本到图像扩散模型在根据输入文本描述生成多样且高质量图像方面取得了令人印象深刻的成功。然而,当输入文本在词汇上存在歧...
微软研究院推出BatteryML:一款用于电池衰减的机器学习开源工具
锂离子电池由于其高能量密度、长循环寿命和低自放电率,在当代能源储存中成为关键所在。这些特性使它们在电动汽车、消费电子...
认识FLM-101B:一个拥有1010亿参数的开源解码器型LLM
最近,大型语言模型(LLM)在自然语言处理(NLP)和多模态任务方面表现出色,但面临两个重大挑战:高计算成本和难以进行公平...
结识TensorRT-LLM:一款在NVIDIA Tensor Core GPU上加速和优化最新LLM推理性能的开源库
人工智能(AI)大型语言模型(LLMs)可以生成文本,翻译语言,写各种形式的创意材料,并为您的问题提供有用的答案。然而,LLM...
认识PyGraft:一款开源的基于Python的人工智能工具,可以生成高度定制化的、与领域无关的模式和知识图谱
一种越来越受欢迎的表示数据的图结构的方法是使用知识图谱(KGs)。KG是一组三元组(s,p,o),其中s(主体)和o(对象)是...
大型语言模型真的能做数学吗?这篇人工智能研究介绍了MathGLM:一个强大的模型,可以在没有计算器的情况下解决数学问题
谈到下游自然语言处理(NLP)任务时,大型语言模型(LLMs)已被证明非常有效。为了生成连贯和相关上下文的回复,像GPT4和Chat...
低成本四足机器人能掌握跑酷吗?揭示了一种革命性的敏捷机器人运动学习系统
使机器人执行复杂的物理任务,比如在具有挑战性的环境中导航,一直以来都是机器人技术领域的一大难题。这个领域中最具挑战性...
“《侏罗纪公园》的等待结束了吗?这种人工智能模型使用图像到图像的转换技术将古老的化石复活了起来”
图像到图像的转换(I2I)是计算机视觉和机器学习领域内的一个有趣领域,它有能力将图像内容从一个域转换到另一个域而无缝衔接...
通过密度提示链增强GPT-4摘要
近年来,大型语言模型由于其出色的能力而备受关注。大型语言模型可以进行问题回答、内容生成、语言翻译和文本摘要等各种任务...
百度AI研究人员推出VideoGen:一种新的文本到视频生成方法,可以生成高清视频并具有高帧率保真度
文本到图像(T2I)生成系统,例如DALL-E2、Imagen、Cogview、Latent Diffusion等,在近年来取得了长足的进展。另一方面,文本...
如何减轻细粒度图像分类中的背景引起的偏差?屏蔽策略和模型架构的比较研究
细粒度图像分类深入研究了在更广泛的类别中区分密切相关的子类别。例如,不仅仅将图像识别为”鸟”,这种方法可以...
谷歌研究员提出了MEMORY-VQ:一种新的人工智能方法,可以减少存储要求,而不会牺牲存储增强模型的性能
近期语言模型的研究强调了提高事实知识的检索增强的重要性。检索增强涉及为这些模型提供相关的文本段落以提高其性能,但这会...
微软研究员发布PromptTTS 2:通过增强语音可变性和成本效益的提示生成,革新文本转语音技术
由于文本到语音系统的最新发展,合成语音的可懂性和自然度得到了改善。已经为多说话者环境创建了大规模的TTS系统,一些TTS系...
LLMs和数据分析:AI如何对大数据进行商业洞察
大型语言模型(LLMs)具有通过广泛的数据集提供有价值的商业洞察的能力。本文探讨了公司如何利用LLMs分析客户评论、社交媒体...
“遇见PhysObjects:一个基于物体的数据集,包含36.9K个众包和417K个自动化的常见家用物品的物理概念标注”
在现实世界中,信息通常通过文本、图片或视频的组合来传达。为了有效地理解和与这些信息互动,人工智能系统必须能够处理两种...
普林斯顿研究人员提出CoALA:一个概念性人工智能框架,用于系统地理解和构建语言代理
在快速发展的人工智能领域中,开发能够理解和生成人类语言的语言代理人已经成为一个巨大的挑战。这些代理人被期望能够理解和...
认识Verba:一个开源工具,用于构建您自己的RAG检索增强生成流水线并利用LLM进行基于内部的输出
Verba是一个开源项目,旨在为RAG应用提供简化、用户友好的界面。用户可以迅速深入数据,并开始进行相关的对话。 Verba不仅仅...
索尼研究人员提出了BigVSAN:通过GAN-Based Vocoders中的切片对抗网络彻底改变音频质量
神经网络的发展和它们不断增长的受欢迎程度导致了语音合成技术的显著改进。大多数语音合成系统使用两阶段方法:首先,它们从...
“认识ResFields:一种新颖的人工智能方法,克服了时空神经场在有效建模长期和复杂时间信号方面的局限性”
用于表示神经连续时空场的最流行的神经网络架构,也称为神经场,是多层感知器。这是因为它可以对任意维度上的连续信号进行编...
“带我走进时间:SceNeRFlow是一种生成时间一致的NeRF的人工智能方法”
神经辐射场(NeRF)最近在3D领域中成为了一个革命性的概念。它重新塑造了我们处理3D对象可视化的方式,并开启了新的可能性。...
- You may be interested
- 使用PyTorch进行高效图像分割:第一部分
- 简化文件共享
- 机器学习的软件工程模式
- 这里是你如何开始使用谷歌的双子座(Gemini...
- Azure B系列虚拟机的强大功能
- 使用还是不使用机器学习
- 2023年值得关注的7大数字营销趋势
- 脑机接口通过耳道连接
- 厌倦了你的数据工程角色了吗?
- 10个由ChatGPT发明的情感(令人惊讶地相关)
- 用Typescript进行空间数据工程
- FunSearch内幕:谷歌DeepMind的新LLM,能...
- 传奇英国宇航员蒂姆·皮克将成为伦敦大数据...
- “14个令人兴奋的Python项目创意和主题,适...
- 遇见AnomalyGPT:一种基于大型视觉-语言模...