全新推出 PaliGemma、Gemma 2 和升级扩展 Responsible AI 工具包作者 / 产品管理总监 Tris Warkentin;高级研究员翟晓华;产品经理 Ludovic Peran 在 Google,我们相信合作和开放研究能够推动创新。我们非常感谢社区对 Gemma 的支...AI 技术文章# Gemma 2# PaliGemma# Responsible AI2年前02890
用 KV 缓存量化解锁长文本生成很高兴和大家分享 Hugging Face 的一项新功能: KV 缓存量化 ,它能够把你的语言模型的速度提升到一个新水平。 太长不看版: KV 缓存量化可在最小化对生成质量的影响的条件下,减少 LLM...AI 技术文章# KV缓存# 量化2年前02890
Hugging Face 论文平台 Daily Papers 功能全解析文/ Adeena, 在快速发展的研究领域,保持对最新进展的关注至关重要。为了帮助开发者和研究人员跟踪 AI 领域的前沿动态,Hugging Face 推出了 Daily Papers 页面。自发布以...AI 技术文章# Daily Papers# Hugging Face2年前02880
Hugging Face Accelerate 两个后端的故事:FSDP 与 DeepSpeed社区中有两个流行的 零冗余优化器(Zero Redundancy Optimizer,ZeRO) 算法实现,一个来自 DeepSpeed,另一个来自 PyTorch。Hugging Face Acce...AI 技术文章# DeepSpeed# FDSP2年前02880
利用英特尔 Gaudi 2 和至强 CPU 构建经济高效的企业级 RAG 应用检索增强生成 (Retrieval Augmented Generation,RAG) 可将存储在外部数据库中的新鲜领域知识纳入大语言模型以增强其文本生成能力。其提供了一种将公司数据与训练期间语言模型...AI 技术文章# Gaudi 2# RAG2年前02830
Ryght 在 Hugging Face 专家助力下赋能医疗保健和生命科学之旅本文是 Ryght 团队的客座博文。 Ryght 是何方神圣? Ryght 的使命是构建一个专为医疗保健和生命科学领域量身定制的企业级生成式人工智能平台。最近,公司正式公开了 Ryght 预览版 平台...AI 技术文章# Ryght2年前02810
BigCodeBench: 继 HumanEval 之后的新一代代码生成测试基准HumanEval 是一个用于评估大型语言模型 (LLM) 在代码生成任务中的参考基准,因为它使得对紧凑的函数级代码片段的评估变得容易。然而,关于其在评估 LLM 编程能力方面的有效性越来越多的担忧...AI 技术文章# BigCodeBench# HumanEval2年前02780
Falcon Mamba: 首个高效的无注意力机制 7B 模型Falcon Mamba 是由阿布扎比的 Technology Innovation Institute (TII) 开发并基于 TII Falcon Mamba 7B License 1.0 的开放...AI 技术文章# Falcon Mamba2年前02760
用 Sentence Transformers v3 训练和微调嵌入模型Sentence Transformers 是一个 Python 库,用于使用和训练各种应用的嵌入模型,例如检索增强生成 (RAG)、语义搜索、语义文本相似度、释义挖掘 (paraphrase min...AI 技术文章# Transformers2年前02760
通过打包 Flash Attention 来提升 Hugging Face 训练效率简单概述 现在,在 Hugging Face 中,使用打包的指令调整示例 (无需填充) 进行训练已与 Flash Attention 2 兼容,这要归功于一个 最近的 PR 以及新的 DataColl...AI 技术文章# Flash Attention# 训练效率2年前02730