Spark Structured Streaming: путь не указан, ошибка - PullRequest
0 голосов
/ 28 сентября 2018

Попытка записи данных в тему Kafka с использованием Spark Structured Streaming и получение следующей ошибки.

aggregatedDataset
        .select(to_json(struct("*")).as("value"))
        .writeStream()
        .outputMode(OutputMode.Append())
        .option("kafka.bootstrap.servers", kafkaBootstrapServersString)
        .option("topic", topic)
        .option("checkpointLocation", checkpointLocation)
        .start();

Stacktrace:

Exception in thread "main" java.lang.IllegalArgumentException: 'path' is not specified
    at org.apache.spark.sql.execution.datasources.DataSource$$anonfun$11.apply(DataSource.scala:276)
    at org.apache.spark.sql.execution.datasources.DataSource$$anonfun$11.apply(DataSource.scala:276)
    at scala.collection.MapLike$class.getOrElse(MapLike.scala:128)
    at org.apache.spark.sql.catalyst.util.CaseInsensitiveMap.getOrElse(CaseInsensitiveMap.scala:28)
    at org.apache.spark.sql.execution.datasources.DataSource.createSink(DataSource.scala:275)
    at org.apache.spark.sql.streaming.DataStreamWriter.start(DataStreamWriter.scala:286)

1 Ответ

0 голосов
/ 28 сентября 2018

В вашем разделе writeStream отсутствует формат, который в вашем случае выглядит как kafka,

 aggregatedDataset
    ...
    .writeStream
    .format("kafka")
    ...

Надеюсь, это поможет!

Добро пожаловать на сайт PullRequest, где вы можете задавать вопросы и получать ответы от других членов сообщества.
...