10月9日消息,科技媒体NeoWin昨日(10月8日)发布博文,报道称微软正与llama.cpp和GGUF开源社区合作,在Windows 11系统上升级Windows ML,实验性原生支持GGUF与ONNX格式模型推理,并推出Windows ML Runtime API。
在Windows与Surface十月活动中,微软介绍了Windows ML的最新进展。Windows ML是微软面向Windows 11的本地AI推理框架,开发者可在设备端运行AI模型,构建文本生成、语音识别等应用,并减少对特定硬件优化的依赖。

微软表示,通过社区合作,开发者现可通过llama.cpp的实验性集成,从Hugging Face导入GGUF模型并直接在本地运行。性能方面,微软还携手英伟达,向llama.cpp及相关性能优化贡献代码。
据介绍,Windows ML新增了实验性Windows原生推理路径,可运行ONNX与GGUF两类模型,该路径正式名称为Windows ML Runtime API,微软称其具备更高性能、更深的系统集成及更细粒度的控制能力。
背景知识:GGUF是一种常用于本地运行大语言模型的模型文件格式,开发者可从Hugging Face等平台获取GGUF模型,并通过llama.cpp等工具在个人电脑上加载与推理;ONNX则是开放神经网络交换格式,用于在不同框架和硬件间迁移AI模型,ONNX Runtime是其常用运行环境,可支持模型在Windows设备上的推理部署。
在Windows ML Runtime API支持下,微软同时推出Text Generation API与Speech Recognition API,开发者可使用这两组接口构建文本生成与语音识别功能。
微软表示,ONNX Runtime API仍将获得完整支持;未来针对Windows的优化将优先投向Windows ML Runtime API。两种运行时均已包含在当前版本中,开发者可按自身熟悉程度选择迁移时机。

微信扫一扫
支付宝扫一扫 