Hacktoberfest 2026: los issues que los mantenedores marcaron para octubre, abiertos y aptos para principiantes. Explorar issues de Hacktoberfest

How to run in Spark on YARN?

Abierto
#133 3 comentarios 0 reacciones 0 asignados Ver en GitHub

Nadie ha tomado este issue todavía.

Evaluación

Dificultad
4/5
Tiempo estimado
3-5 días
Aptitud para principiantes
25/100
Tipo de issue
Documentación
Claridad
Necesita aclaración
Estado de actividad
Estancado
Stack tecnológico
hadoop, python, scala, spark, tensorflow

Línea de trabajo

Comience con el comando spark-submit indicado, su error «Missing application resource» y la configuración especificada del clúster YARN y Virtualenv. Determine el recurso de aplicación requerido y si Tensorframes y TensorFlow deben estar disponibles en los nodos de trabajo; se considera terminado cuando se hayan documentado un comando de envío a YARN que funcione y los requisitos de despliegue.

Escrito por el modelo de indexación a partir del texto del issue.

Descripción

Hi, Everyone. Tensorframe is interesting to me. So I want to test Tensorframe in my Spark's cluster. But I have wonder.

  1. I wondering that Tensorframe just needs to install to master node and don't needs to install any worker.
  2. This command is okay that "pyspark --packages databricks:tensorframes:0.2.9-s_2.11"
    But I want to use Spark's cluster. So, I want to use this command "spark-submit --packages databricks:tensorframes:0.2.9-s_2.11". But this command has the error like this:
Exception in thread "main" java.lang.IllegalArgumentException: Missing application resource.
       at org.apache.spark.launcher.CommandBuilderUtils.checkArgument(CommandBuilderUtils.java:241)
       at org.apache.spark.launcher.SparkSubmitCommandBuilder.buildSparkSubmitArgs(SparkSubmitCommandBuilder.java:160)
       at org.apache.spark.launcher.SparkSubmitCommandBuilder.buildSparkSubmitCommand(SparkSubmitCommandBuilder.java:274)
       at org.apache.spark.launcher.SparkSubmitCommandBuilder.buildCommand(SparkSubmitCommandBuilder.java:151)
       at org.apache.spark.launcher.Main.main(Main.java:86)

Someone have this error?

  • I have Spark's cluster that has 3 nodes (YARN on a Hadoop cluster, 1 master, 2 worker)
  • I used Virtualenv for Tensorflow(CPU version)
  • I install panda-0.20.3

I would be grateful if you could please answer my question.

Lenguaje dominante
Scala
Estrellas
743
Forks
158
Métricas de merge de PR
Sin PR fusionados en 30 d

Guía de contribución

No hay ninguna guía de contribución indexada para este repositorio

Primeros pasos

  1. Lee el issue completo y luego la guía de contribución del proyecto.
  2. Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
  3. Haz un fork del repositorio y trabaja en una rama.
  4. Abre un pull request que haga referencia al número del issue.

Más de databricks/tensorframes

Todos los issues de databricks/tensorframes

Issues similares

Más issues de Scala

Recibe los nuevos issues en tu correo

Un resumen breve de issues de GitHub para principiantes.