Learn more about Technology - Section 10
麻省理工学院的研究人员开发出一种人工智能技术,使机器人能够利用整只手来制定复杂的操纵物体的计划
全身操纵是人类的优势,但是机器人的弱点。机器人将盒子和搬运者的手指、手臂或躯干之间的每个可能的接触点解释为独立的接触...
DeepMind研究人员介绍了Reinforced Self-Training(ReST):一种简单的算法,通过Growing Batch Reinforcement Learning(RL)受到人类偏好的启发,用于将LLMs与人类偏好对齐
大型语言模型(LLMs)非常善于产生写作流畅的内容并解决各种语言问题。这些模型通过使用大量的文本和计算进行训练,以增加下...
“认识AutoGPTQ:基于GPTQ算法的易于使用的LLMs量化包,提供用户友好的API”
来自Hugging Face的研究人员提出了一种创新解决方案,以应对训练和部署大型语言模型(LLMs)所需的资源密集型需求。他们在Tra...
数据合约在数据管道中的作用
什么是数据契约? 数据契约是定义系统内数据应如何结构化和处理的协议或一组规则。它作为组织内部不同部分或不同软件组件之间...
MIT的这项AI研究展示了基于光的机器学习系统如何能产生更强大和高效的大型语言模型
深度神经网络(DNN)就像计算机的超级大脑。它们擅长从大量信息中找出棘手的东西。它们使计算机足够聪明,能够理解图片,像人...
腾讯AI实验室的研究人员推出了IP-Adapter:一种用于文本到图像扩散模型的文本兼容图像提示适配器
“苹果”,瞬间你的脑海中浮现出一个苹果的图像。我们的大脑如此迷人,同样令人着迷的是,生成式人工智能带来了同样的创造力和...
Meta AI发布了SeamlessM4T:一个基础的多语言和多任务模型,可以在语音和文本之间无缝地进行翻译和转录
在一个越来越全球化的互动世界中,掌握多种语言可以弥合鸿沟,促进理解,并为各种机遇打开大门。学习多种语言可以帮助我们深...
这篇人工智能论文提出了MATLABER:一种新颖的潜在BRDF自编码器,用于材质感知的文本到3D生成
3D资产的开发对于许多商业应用非常重要,包括游戏、电影和AR/VR。传统的3D资产开发过程需要许多耗时且劳动密集的步骤,所有这...
阅读《头像:逼真的情感可控音频驱动头像》
现有的音频驱动的深度伪造技术存在一个关键限制,即需要更多的能力来控制风格属性理想情况下,我们希望改变这些方面,例如,...
解码情绪:用EmoTX,一种新的基于Transformer的AI框架揭示情感和心理状态
电影是最富有艺术表达力的故事和情感之一。例如,在《追求快乐》中,主角经历了一系列情绪变化,体验了分手和无家可归等低谷...
Deci推出DeciCoder:一款用于代码生成的开源1B参数大型语言模型
在快节奏的AI世界中,高效的代码生成是一个不容忽视的挑战。随着越来越复杂的模型的出现,对准确代码生成的需求也迅速增长,...
从文字到世界:使用AI多模态细粒度视频描述探索视频叙述
语言是人类互动的主要方式,不仅提供其他感官如视觉和听觉的补充细节,还作为传递信息的有效渠道,例如使用语音导航引导我们...
认识AudioLDM 2 一个独特的用于音频生成的AI框架,它融合了语音、音乐和音效
在一个越来越依赖于人工智能和深度学习概念的世界中,音频生成领域正在经历一场突破性的变革,引入了AudioLDM 2。这个创新框...
“认识EasyEdit:一款易于使用的用于LLMs的知识编辑AI框架”
我们不断需要跟上这个不断变化的世界,机器学习模型也需要如此,以产生精确的输出。大型语言模型通常会遇到谬误问题,即它们...
美国法院否决AI生成的艺术享有版权的要求
在一项可能重塑艺术和技术领域的关键决定中,美国一名联邦法官裁定不授予由人工智能(AI)生成的艺术品版权。这个判决可能会...
“遇见 SQLCoder:一种新的开源和顶尖模型,用于将自然语言问题转换为 SQL 查询”
Defog.ai发布了SQLCoder,这是一个先进的模型,用于将自然语言查询转化为数据库查询。针对Postgres中的通用SQL架构,SQLCoder...
使用OpenAI和FastAPI构建具有记忆微服务的对话代理
释放可能性:使用Python开发AI驱动的智能体,为个性化体验学习使用Python、OpenAI和FastAPI创建高级对话智能体无缝构建上下文...
“革命性的实时1080p新视角合成:基于3D高斯和可见性感知渲染的突破”
网格和点是最常见的三维场景表示,因为它们是明确的,非常适合于快速的GPU/CUDA光栅化。相比之下,最近的神经辐射场(NeRF)...
2023年视频创作和编辑的40多个AI工具
Adobe Premiere Pro Adobe Premiere Pro是一款具有AI功能的视频编辑软件,可以让用户快速创建令人惊叹的视频。其功能包括色彩...
Together AI发布了Llama-2-7B-32K-Instruct:扩展上下文语言处理的突破
在自然语言处理的广阔领域中,出现了一个多方面的挑战:即熟练理解和回应复杂而冗长的指令。随着沟通细微差别变得更加复杂,...
- You may be interested
- 在远程工作的时代培养新一代数据科学家
- 揭示AI幻觉:解码AI模型的黑暗面
- 增强代理生产力,使用Salesforce集成进行...
- 离散时间马尔可夫链——在返现活动中识别获...
- 遇见Metaphy Labs的AI传道者
- 意大利的一项新的人工智能研究介绍了一种...
- 如何使用索引加速SQL查询 [Python版]
- 欧盟为人工智能推出新规
- 谷歌的DeepMind正在改革机器人技术 (Gǔgē ...
- Gradio 正式加入 Hugging Face!
- “填补空白:揭开菲律宾2022年贸易网络的隐...
- 元研究人员引入了VR-NeRF:一种用于高保真...
- 巴德在欧洲和巴西首次亮相,同时也面临隐...
- NVIDIA H100 GPU 现已在 AWS 云上可用
- 使用LangChain和GPT-3构建一个透明的文档...