<?xml version="1.0"?>
<feed xmlns="http://www.w3.org/2005/Atom" xml:lang="ko">
	<id>https://wiki.conaondaapps.com/index.php?action=history&amp;feed=atom&amp;title=ONNX_Runtime</id>
	<title>ONNX Runtime - 편집 역사</title>
	<link rel="self" type="application/atom+xml" href="https://wiki.conaondaapps.com/index.php?action=history&amp;feed=atom&amp;title=ONNX_Runtime"/>
	<link rel="alternate" type="text/html" href="https://wiki.conaondaapps.com/index.php?title=ONNX_Runtime&amp;action=history"/>
	<updated>2026-08-20T14:22:26Z</updated>
	<subtitle>이 문서의 편집 역사</subtitle>
	<generator>MediaWiki 1.46.0</generator>
	<entry>
		<id>https://wiki.conaondaapps.com/index.php?title=ONNX_Runtime&amp;diff=41&amp;oldid=prev</id>
		<title>Admina7ec671ac513: migrate: import legacy Wiki content to Vultr</title>
		<link rel="alternate" type="text/html" href="https://wiki.conaondaapps.com/index.php?title=ONNX_Runtime&amp;diff=41&amp;oldid=prev"/>
		<updated>2026-08-20T04:18:51Z</updated>

		<summary type="html">&lt;p&gt;migrate: import legacy Wiki content to Vultr&lt;/p&gt;
&lt;p&gt;&lt;b&gt;새 문서&lt;/b&gt;&lt;/p&gt;&lt;div&gt;&amp;#039;&amp;#039;&amp;#039;[[ONNX]] Runtime&amp;#039;&amp;#039;&amp;#039;은 [[ONNX]](Open Neural Network Exchange) 형식으로 저장된 머신 러닝 모델을 실행하는 고성능 추론 엔진이다. Microsoft가 주도하여 개발하며, 다양한 하드웨어 가속기와 실행 공급자를 통해 크로스 플랫폼 추론을 지원한다.&lt;br /&gt;
&lt;br /&gt;
== 개요 ==&lt;br /&gt;
[[ONNX]] Runtime은 2018년 첫 공개 이후 PyTorch, TensorFlow 등 주요 프레임워크에서 내보낸 [[ONNX]] 모델을 실행하는 사실상의 표준 추론 엔진으로 자리잡았다. 학습보다는 추론에 특화되어 있으며, CPU뿐 아니라 GPU, NPU, FPGA 등 다양한 하드웨어에서 최적화된 실행을 제공한다.&lt;br /&gt;
&lt;br /&gt;
== 실행 공급자(Execution Provider) ==&lt;br /&gt;
[[ONNX]] Runtime의 핵심 설계 요소로, 실행 공급자(EP)를 교체함으로써 동일한 모델을 서로 다른 하드웨어에서 실행할 수 있다.&lt;br /&gt;
&lt;br /&gt;
* CPU — 기본 실행 공급자, Intel MKL-ML 최적화 포함&lt;br /&gt;
* CUDA — NVIDIA GPU 가속&lt;br /&gt;
* [[DirectML]] — Windows의 모든 DirectX 12 GPU에서 가속&lt;br /&gt;
* TensorRT — NVIDIA GPU 고성능 추론&lt;br /&gt;
* OpenVINO — Intel CPU/GPU/iGPU/NPU&lt;br /&gt;
* CoreML — Apple Silicon (macOS/iOS)&lt;br /&gt;
* QNN — Qualcomm NPU&lt;br /&gt;
* WebNN — 웹 브라우저 기반 추론&lt;br /&gt;
&lt;br /&gt;
== 활용 사례 ==&lt;br /&gt;
&lt;br /&gt;
=== 로컬 AI ===&lt;br /&gt;
[[llama.cpp]]와 [[올라마]] 등이 [[ONNX]] 모델을 지원하며, [[ONNX]] Runtime을 통해 다양한 하드웨어 가속을 활용한다. 특히 [[Stable Diffusion]]의 [[ONNX]] 변환 모델을 [[ONNX]] Runtime + [[DirectML]] 조합으로 AMD GPU에서 실행하는 방식이 널리 쓰인다.&lt;br /&gt;
&lt;br /&gt;
=== 엣지 및 모바일 ===&lt;br /&gt;
[[ONNX]] Runtime Mobile 패키지는 Android/iOS 환경에서 경량화된 추론을 지원하며, Qualcomm QNN, Apple CoreML 등 모바일 특화 실행 공급자와 통합된다.&lt;br /&gt;
&lt;br /&gt;
== 함께 보기 ==&lt;br /&gt;
&lt;br /&gt;
* [[DirectML]] — Windows GPU 실행 공급자&lt;br /&gt;
* [[llama.cpp]] — [[ONNX]] 모델을 지원하는 LLM 추론 도구&lt;br /&gt;
* [[Stable Diffusion]] — [[ONNX]] Runtime으로 가속 가능한 이미지 생성 모델&lt;br /&gt;
&lt;br /&gt;
== 출처 ==&lt;br /&gt;
&lt;br /&gt;
* [https://onnxruntime.ai/ ONNX Runtime 공식 웹사이트]&lt;br /&gt;
* [https://github.com/microsoft/onnxruntime GitHub: microsoft/onnxruntime]&lt;br /&gt;
&lt;br /&gt;
[[분류:머신 러닝]]&lt;br /&gt;
[[분류:마이크로소프트]]&lt;br /&gt;
[[분류:추론 엔진]]&lt;/div&gt;</summary>
		<author><name>Admina7ec671ac513</name></author>
	</entry>
</feed>