[CUDA]: GPU Device Caching for Encoder Output in CUDA Backend #2548
metal.yml
on: pull_request
Matrix: export-model-metal-artifact
test-executorch-metal-build
/
macos-job
5m 9s
Matrix: test-model-metal-e2e
Artifacts
Produced during runtime
| Name | Size | Digest | |
|---|---|---|---|
|
mistralai-Voxtral-Mini-3B-2507-metal-non-quantized
Expired
|
6.82 GB |
sha256:318457e352101dd7fa10f0518cddfb5c893539ea76ac23d68936df358f86f321
|
|
|
openai-whisper-large-v3-turbo-metal-non-quantized
Expired
|
1.18 GB |
sha256:70b323b5789f6ceaa9535b8d1ccf9b59451803d37464dfe448bf6e8d6de33c83
|
|
|
openai-whisper-small-metal-non-quantized
Expired
|
361 MB |
sha256:e7980fbbb5fa841b25d4889f6661708a6bdb1af328fa0de51792350ec8cce800
|
|