He pasado 14 horas al día trabajando con IA Claude en un proyecto personal y no podría estar más contento. Soy Akio, ingeniero en una startup de desarrollo de IA, y en este artículo describo la experiencia de ejecutar SAM 3 en hardware AMD Ryzen AI Max+ 395 y la solución a un error de rocBLAS que afecta a muchos usuarios.
Equipo y contexto Windows 11, pila ROCm HIP SDK, PyTorch ROCm, y el último modelo de segmentación de Meta SAM 3. La máquina AMD Ryzen AI Max+ 395 cuenta con iGPU potente y memoria de alto ancho de banda. Aunque SAM 3 es ligero y normalmente encajaría mejor en una dGPU NVIDIA, la motivación fue experimentar la última novedad en hardware AMD.
El problema tras lanzar la inferencia fue un alud de errores rocBLAS error TensileLibrary.dat not found que indica que no se encuentran las librerías para el dispositivo gfx1151. La solución habitual en AMD es spoofear la variable de entorno con $env:HSA_OVERRIDE_GFX_VERSION = 11.0.0 para indicar compatibilidad con gfx1100, pero en este caso no bastó y PyTorch seguía buscando en site-packages/_rocm_sdk_libraries_gfx1151/bin.
La información en la web era escasa porque el hardware es muy nuevo. Tras una búsqueda profunda encontré la solución examinando localmente las carpetas de la instalación de PyTorch ROCm. En site-packages apareció un directorio inesperado _rocm_sdk_libraries_custom que contenía archivos para gfx1151, entre ellos TensileLibrary_lazy_gfx1151.dat y otros .hsaco.
La causa fue un desfase entre la estructura de carpetas que PyTorch espera y la ubicación real de las librerías, un problema de rutas más que de ausencia de archivos. La solución consiste en mover los ficheros al lugar correcto. Pasos resumidos:
Paso 1 Copiar los archivos desde site-packages/_rocm_sdk_libraries_custom/bin/rocblas/library incluyendo .dat y .hsaco.
Paso 2 Crear en site-packages la carpeta _rocm_sdk_libraries_gfx1151 y dentro crear bin.
Paso 3 Pegar los archivos en la carpeta bin creada. Como precaución duplicar TensileLibrary_lazy_gfx1151.dat y renombrar la copia a TensileLibrary.dat. Esto hace que PyTorch encuentre las librerías donde las espera.
Resultado Tras la llamada de nuevo al script el error desapareció y SAM 3 corrió usando la iGPU del Ryzen AI Max+ 395. Uso de VRAM aproximado 7GB y tiempo de inferencia por imagen alrededor de 8 segundos. No es suficiente para video en tiempo real, pero demuestra que los modelos de visión recientes pueden ejecutarse en hardware AMD con la configuración apropiada.
Lecciones aprendidas y recomendaciones No confiar solo en los mensajes de error a primera vista; inspeccionar la estructura de carpetas puede revelar archivos ocultos. En hardware reciente la sincronización entre drivers y librerías puede estar desfasada, por lo que este tipo de soluciones manuales son a menudo temporales. Para empresas que buscan implementar soluciones de inteligencia artificial y agentes IA en producción, es importante contar con soporte profesional en integración y despliegue.
Sobre Q2BSTUDIO En Q2BSTUDIO somos una empresa de desarrollo de software y aplicaciones a medida, especialistas en inteligencia artificial, ciberseguridad y servicios cloud. Ofrecemos desde software a medida hasta servicios de ciber-seguridad y pentesting, y trabajamos con plataformas cloud como AWS y Azure. Si te interesa el desarrollo de aplicaciones y software a medida visita nuestros servicios de desarrollo de aplicaciones y software a medida y si buscas capacidades avanzadas en IA consulta nuestros servicios de inteligencia artificial para empresas.
Palabras clave y servicios aplicables Este caso es relevante para proyectos de aplicaciones a medida, software a medida, inteligencia artificial, ciberseguridad, servicios cloud aws y azure, servicios inteligencia de negocio, ia para empresas, agentes IA y power bi. En Q2BSTUDIO podemos ayudar a integrar modelos como SAM 3 en soluciones empresariales, optimizar infraestructuras cloud, y ofrecer pipelines de despliegue seguros.
Próximos pasos Planeo publicar un artículo sobre cómo combinar SAM 3 con cámaras IoT basadas en ESP32 y casos prácticos de implementación. Si quieres que probemos modelos más pesados en el Ryzen AI Max+ 395 o necesitas una auditoría de integración para tu proyecto, ponte en contacto con Q2BSTUDIO y te asesoramos.





