微软升级Windows ML:实验性原生支持GGUF与ONNX模型推理 - 果核剥壳

10月9日消息,科技媒体NeoWin昨日(10月8日)发布博文,报道称微软正与llama.cpp和GGUF开源社区合作,在Windows 11系统上升级Windows ML,实验性原生支持GGUF与ONNX格式模型推理,并推出Windows ML Runtime API。

在Windows与Surface十月活动中,微软介绍了Windows ML的最新进展。Windows ML是微软面向Windows 11的本地AI推理框架,开发者可在设备端运行AI模型,构建文本生成、语音识别等应用,并减少对特定硬件优化的依赖。

微软升级Windows ML:实验性原生支持GGUF与ONNX模型推理

微软表示,通过社区合作,开发者现可通过llama.cpp的实验性集成,从Hugging Face导入GGUF模型并直接在本地运行。性能方面,微软还携手英伟达,向llama.cpp及相关性能优化贡献代码。

据介绍,Windows ML新增了实验性Windows原生推理路径,可运行ONNX与GGUF两类模型,该路径正式名称为Windows ML Runtime API,微软称其具备更高性能、更深的系统集成及更细粒度的控制能力。

背景知识:GGUF是一种常用于本地运行大语言模型的模型文件格式,开发者可从Hugging Face等平台获取GGUF模型,并通过llama.cpp等工具在个人电脑上加载与推理;ONNX则是开放神经网络交换格式,用于在不同框架和硬件间迁移AI模型,ONNX Runtime是其常用运行环境,可支持模型在Windows设备上的推理部署。

在Windows ML Runtime API支持下,微软同时推出Text Generation API与Speech Recognition API,开发者可使用这两组接口构建文本生成与语音识别功能。

微软表示,ONNX Runtime API仍将获得完整支持;未来针对Windows的优化将优先投向Windows ML Runtime API。两种运行时均已包含在当前版本中,开发者可按自身熟悉程度选择迁移时机。

 

如果您喜欢本站,点击这儿不花一分钱捐赠本站

这些信息可能会帮助到你: 下载帮助 | 报毒说明 | 进站必看

修改版本安卓软件,加群提示为修改者自留,非本站信息,注意鉴别

赞 (0)
上一篇 2小时前
下一篇 2小时前

相关推荐

发表回复

评论问题之前,点击我,能帮你解决大部分问题

您的电子邮箱地址不会被公开。 必填项已用*标注