# Can't write VEP annotated hail table

**URL:** <https://discuss.hail.is/t/cant-write-vep-annotated-hail-table/855>\
**Category:** Hail Query & hailctl\
**Created:** [February 10, 2019, 1:04am UTC](https://discuss.hail.is/t/cant-write-vep-annotated-hail-table/855 "2019-02-10T01:04:07Z")\
**Posts on this page:** 5\
**Page:** 1

<div class="post-metadata">

**Author:** ![Jack-Ow](https://yyz2.discourse-cdn.com/flex036/user_avatar/discuss.hail.is/jack-ow/32/304_2.png) [@Jack-Ow](https://discuss.hail.is/u/Jack-Ow)\
**Post date:** [February 10, 2019, 1:04am UTC](https://discuss.hail.is/t/cant-write-vep-annotated-hail-table/855/1 "2019-02-10T01:04:07Z")

</div>

Hi,

I’ve no problem export hail table to S3 after importing it as vcf but I am encountering issue export the hail table after vep annotated it. The error was “Error summary: IOException: error=2, No such file or directory” . I’ve ran vep release 89.5 via docker and used the same json file as in the example of vep below with changes only to the vep command. It didn’t gave me error.

[https://hail.is/docs/0.2/methods/genetics.html?highlight=vep#hail.methods.vep](https://hail.is/docs/0.2/methods/genetics.html?highlight=vep#hail.methods.vep)  
Hail version : 0.2.9-6f862a0873f5

---

<div class="post-metadata">

**Author:** ![tpoterba](https://yyz2.discourse-cdn.com/flex036/user_avatar/discuss.hail.is/tpoterba/32/61_2.png) [@tpoterba](https://discuss.hail.is/u/tpoterba)\
**Post date:** [February 11, 2019, 10:03am UTC](https://discuss.hail.is/t/cant-write-vep-annotated-hail-table/855/2 "2019-02-11T10:03:11Z")

</div>

Since Hail builds a graph of computations and executes that graph lazily, you can totally have the `hl.vep` line execute successfully, but get a VEP-related failure in a `write`. That sounds like what’s going on here.

What was the full error message?

---

<div class="post-metadata">

**Author:** ![Jack-Ow](https://yyz2.discourse-cdn.com/flex036/user_avatar/discuss.hail.is/jack-ow/32/304_2.png) [@Jack-Ow](https://discuss.hail.is/u/Jack-Ow)\
**Post date:** [February 11, 2019, 1:09pm UTC](https://discuss.hail.is/t/cant-write-vep-annotated-hail-table/855/3 "2019-02-11T13:09:10Z")

</div>

It’s a long error message.

…  
is.hail.sparkextras.ContextRDD$$anonfun$run$1$$anonfun$apply$8.apply(ContextRDD.scala:149)  
at scala.collection.Iterator$$anon$12.nextCur(Iterator.scala:434)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:440)  
at scala.collection.Iterator$class.foreach(Iterator.scala:893)  
at scala.collection.AbstractIterator.foreach(Iterator.scala:1336)  
at scala.collection.generic.Growable$class.$plus$plus$eq(Growable.scala:59)  
at scala.collection.mutable.ArrayBuffer.$plus$plus$eq(ArrayBuffer.scala:104)  
at scala.collection.mutable.ArrayBuffer.$plus$plus$eq(ArrayBuffer.scala:48)  
at scala.collection.TraversableOnce$class.to(TraversableOnce.scala:310)  
at scala.collection.AbstractIterator.to(Iterator.scala:1336)  
at scala.collection.TraversableOnce$class.toBuffer(TraversableOnce.scala:302)  
at scala.collection.AbstractIterator.toBuffer(Iterator.scala:1336)  
at scala.collection.TraversableOnce$class.toArray(TraversableOnce.scala:289)  
at scala.collection.AbstractIterator.toArray(Iterator.scala:1336)  
at org.apache.spark.rdd.RDD$$anonfun$collect$1$$anonfun$12.apply(RDD.scala:945)  
at org.apache.spark.rdd.RDD$$anonfun$collect$1$$anonfun$12.apply(RDD.scala:945)  
at org.apache.spark.SparkContext$$anonfun$runJob$5.apply(SparkContext.scala:2074)  
at org.apache.spark.SparkContext$$anonfun$runJob$5.apply(SparkContext.scala:2074)  
at org.apache.spark.scheduler.ResultTask.runTask(ResultTask.scala:87)  
at org.apache.spark.scheduler.Task.run(Task.scala:109)  
at org.apache.spark.executor.Executor$TaskRunner.run(Executor.scala:345)  
at java.util.concurrent.ThreadPoolExecutor.runWorker(ThreadPoolExecutor.java:1149)  
at java.util.concurrent.ThreadPoolExecutor$Worker.run(ThreadPoolExecutor.java:624)  
at java.lang.Thread.run(Thread.java:748)  
Caused by: java.io.IOException: error=2, No such file or directory  
at java.lang.UNIXProcess.forkAndExec(Native Method)  
at java.lang.UNIXProcess.(UNIXProcess.java:247)  
at java.lang.ProcessImpl.start(ProcessImpl.java:134)  
at java.lang.ProcessBuilder.start(ProcessBuilder.java:1029)  
… 120 more

Driver stacktrace:  
at org.apache.spark.scheduler.DAGScheduler.org$apache$spark$scheduler$DAGScheduler$$failJobAndIndependentStages(DAGScheduler.scala:1803)  
at org.apache.spark.scheduler.DAGScheduler$$anonfun$abortStage$1.apply(DAGScheduler.scala:1791)  
at org.apache.spark.scheduler.DAGScheduler$$anonfun$abortStage$1.apply(DAGScheduler.scala:1790)  
at scala.collection.mutable.ResizableArray$class.foreach(ResizableArray.scala:59)  
at scala.collection.mutable.ArrayBuffer.foreach(ArrayBuffer.scala:48)  
at org.apache.spark.scheduler.DAGScheduler.abortStage(DAGScheduler.scala:1790)  
at org.apache.spark.scheduler.DAGScheduler$$anonfun$handleTaskSetFailed$1.apply(DAGScheduler.scala:871)  
at org.apache.spark.scheduler.DAGScheduler$$anonfun$handleTaskSetFailed$1.apply(DAGScheduler.scala:871)  
at scala.Option.foreach(Option.scala:257)  
at org.apache.spark.scheduler.DAGScheduler.handleTaskSetFailed(DAGScheduler.scala:871)  
at org.apache.spark.scheduler.DAGSchedulerEventProcessLoop.doOnReceive(DAGScheduler.scala:2024)  
at org.apache.spark.scheduler.DAGSchedulerEventProcessLoop.onReceive(DAGScheduler.scala:1973)  
at org.apache.spark.scheduler.DAGSchedulerEventProcessLoop.onReceive(DAGScheduler.scala:1962)  
at org.apache.spark.util.EventLoop$$anon$1.run(EventLoop.scala:48)  
at org.apache.spark.scheduler.DAGScheduler.runJob(DAGScheduler.scala:682)  
at org.apache.spark.SparkContext.runJob(SparkContext.scala:2034)  
at org.apache.spark.SparkContext.runJob(SparkContext.scala:2055)  
at org.apache.spark.SparkContext.runJob(SparkContext.scala:2074)  
at org.apache.spark.SparkContext.runJob(SparkContext.scala:2099)  
at org.apache.spark.rdd.RDD$$anonfun$collect$1.apply(RDD.scala:945)  
at org.apache.spark.rdd.RDDOperationScope$.withScope(RDDOperationScope.scala:151)  
at org.apache.spark.rdd.RDDOperationScope$.withScope(RDDOperationScope.scala:112)  
at org.apache.spark.rdd.RDD.withScope(RDD.scala:363)  
at org.apache.spark.rdd.RDD.collect(RDD.scala:944)  
at is.hail.sparkextras.ContextRDD.collect(ContextRDD.scala:153)  
at is.hail.io.RichContextRDDRegionValue$.writeRowsSplit$extension(RowStore.scala:1431)  
at is.hail.rvd.RVD.writeRowsSplit(RVD.scala:686)  
at is.hail.expr.ir.MatrixValue.write(MatrixValue.scala:177)  
at is.hail.expr.ir.MatrixNativeWriter.apply(MatrixWriter.scala:28)  
at is.hail.expr.ir.Interpret$.apply(Interpret.scala:774)  
at is.hail.expr.ir.Interpret$.apply(Interpret.scala:93)  
at is.hail.expr.ir.Interpret$.apply(Interpret.scala:63)  
at is.hail.expr.ir.Interpret$.interpretJSON(Interpret.scala:22)  
at is.hail.expr.ir.Interpret.interpretJSON(Interpret.scala)  
at sun.reflect.NativeMethodAccessorImpl.invoke0(Native Method)  
at sun.reflect.NativeMethodAccessorImpl.invoke(NativeMethodAccessorImpl.java:62)  
at sun.reflect.DelegatingMethodAccessorImpl.invoke(DelegatingMethodAccessorImpl.java:43)  
at java.lang.reflect.Method.invoke(Method.java:498)  
at py4j.reflection.MethodInvoker.invoke(MethodInvoker.java:244)  
at py4j.reflection.ReflectionEngine.invoke(ReflectionEngine.java:357)  
at py4j.Gateway.invoke(Gateway.java:282)  
at py4j.commands.AbstractCommand.invokeMethod(AbstractCommand.java:132)  
at py4j.commands.CallCommand.execute(CallCommand.java:79)  
at py4j.GatewayConnection.run(GatewayConnection.java:238)  
at java.lang.Thread.run(Thread.java:748)

java.io.IOException: Cannot run program “docker exec -d my\_vep\_run vep”: error=2, No such file or directory  
at java.lang.ProcessBuilder.start(ProcessBuilder.java:1048)  
at is.hail.utils.richUtils.RichIterator$.pipe$extension(RichIterator.scala:47)  
at is.hail.methods.VEP$$anonfun$7$$anonfun$apply$4.apply(VEP.scala:133)  
at is.hail.methods.VEP$$anonfun$7$$anonfun$apply$4.apply(VEP.scala:129)  
at scala.collection.Iterator$$anon$12.nextCur(Iterator.scala:434)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:440)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at scala.collection.Iterator$$anon$11.hasNext(Iterator.scala:408)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at scala.collection.Iterator$$anon$11.hasNext(Iterator.scala:408)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at is.hail.rvd.RVD$$anonfun$apply$25$$anon$3.hasNext(RVD.scala:1266)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at scala.collection.Iterator$$anon$11.hasNext(Iterator.scala:408)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at scala.collection.Iterator$$anon$11.hasNext(Iterator.scala:408)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at org.apache.spark.storage.memory.MemoryStore.putIteratorAsValues(MemoryStore.scala:216)  
at org.apache.spark.storage.BlockManager$$anonfun$doPutIterator$1.apply(BlockManager.scala:1094)  
at org.apache.spark.storage.BlockManager$$anonfun$doPutIterator$1.apply(BlockManager.scala:1085)  
at org.apache.spark.storage.BlockManager.doPut(BlockManager.scala:1020)  
at org.apache.spark.storage.BlockManager.doPutIterator(BlockManager.scala:1085)  
at org.apache.spark.storage.BlockManager.getOrElseUpdate(BlockManager.scala:811)  
at org.apache.spark.rdd.RDD.getOrCompute(RDD.scala:335)  
at org.apache.spark.rdd.RDD.iterator(RDD.scala:286)  
at org.apache.spark.rdd.MapPartitionsRDD.compute(MapPartitionsRDD.scala:49)  
at org.apache.spark.rdd.RDD.computeOrReadCheckpoint(RDD.scala:324)  
at org.apache.spark.rdd.RDD.iterator(RDD.scala:288)  
at org.apache.spark.rdd.MapPartitionsRDD.compute(MapPartitionsRDD.scala:49)  
at org.apache.spark.rdd.RDD.computeOrReadCheckpoint(RDD.scala:324)  
at org.apache.spark.rdd.RDD.iterator(RDD.scala:288)  
at org.apache.spark.rdd.MapPartitionsRDD.compute(MapPartitionsRDD.scala:49)  
at org.apache.spark.rdd.RDD.computeOrReadCheckpoint(RDD.scala:324)  
at org.apache.spark.rdd.RDD.iterator(RDD.scala:288)  
at org.apache.spark.rdd.MapPartitionsRDD.compute(MapPartitionsRDD.scala:49)  
at org.apache.spark.rdd.RDD.computeOrReadCheckpoint(RDD.scala:324)  
at org.apache.spark.rdd.RDD.iterator(RDD.scala:288)  
at is.hail.sparkextras.ContextRDD.iterator(ContextRDD.scala:546)  
at is.hail.sparkextras.RepartitionedOrderedRDD2$$anonfun$compute$1$$anonfun$apply$1.apply(RepartitionedOrderedRDD2.scala:60)  
at is.hail.sparkextras.RepartitionedOrderedRDD2$$anonfun$compute$1$$anonfun$apply$1.apply(RepartitionedOrderedRDD2.scala:59)  
at scala.collection.Iterator$$anon$12.nextCur(Iterator.scala:434)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:440)  
at scala.collection.Iterator$$anon$18.hasNext(Iterator.scala:764)  
at scala.collection.Iterator$$anon$13.hasNext(Iterator.scala:461)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at is.hail.io.RichContextRDDRegionValue$$anonfun$boundary$extension$1$$anon$1.hasNext(RowStore.scala:1301)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at scala.collection.Iterator$$anon$1.hasNext(Iterator.scala:1004)  
at is.hail.utils.richUtils.RichIterator$$anon$5.isValid(RichIterator.scala:22)  
at is.hail.utils.StagingIterator.isValid(FlipbookIterator.scala:48)  
at is.hail.utils.FlipbookIterator$$anon$9.setValue(FlipbookIterator.scala:331)  
at is.hail.utils.FlipbookIterator$$anon$9.(FlipbookIterator.scala:344)  
at is.hail.utils.FlipbookIterator.leftJoinDistinct(FlipbookIterator.scala:323)  
at is.hail.annotations.OrderedRVIterator.leftJoinDistinct(OrderedRVIterator.scala:62)  
at is.hail.rvd.KeyedRVD$$anonfun$6.apply(KeyedRVD.scala:88)  
at is.hail.rvd.KeyedRVD$$anonfun$6.apply(KeyedRVD.scala:88)  
at is.hail.rvd.KeyedRVD$$anonfun$orderedJoinDistinct$1.apply(KeyedRVD.scala:98)  
at is.hail.rvd.KeyedRVD$$anonfun$orderedJoinDistinct$1.apply(KeyedRVD.scala:95)  
at is.hail.sparkextras.ContextRDD$$anonfun$czipPartitions$1$$anonfun$apply$34.apply(ContextRDD.scala:416)  
at is.hail.sparkextras.ContextRDD$$anonfun$czipPartitions$1$$anonfun$apply$34.apply(ContextRDD.scala:416)  
at is.hail.sparkextras.ContextRDD$$anonfun$cmapPartitionsWithIndex$1$$anonfun$apply$30$$anonfun$apply$31.apply(ContextRDD.scala:369)  
at is.hail.sparkextras.ContextRDD$$anonfun$cmapPartitionsWithIndex$1$$anonfun$apply$30$$anonfun$apply$31.apply(ContextRDD.scala:369)  
at scala.collection.Iterator$$anon$12.nextCur(Iterator.scala:434)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:440)  
at is.hail.rvd.RVD$$anonfun$apply$25$$anon$3.hasNext(RVD.scala:1266)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at scala.collection.Iterator$$anon$11.hasNext(Iterator.scala:408)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at is.hail.rvd.RVD$$anonfun$apply$25$$anon$3.hasNext(RVD.scala:1266)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at scala.collection.Iterator$$anon$11.hasNext(Iterator.scala:408)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at is.hail.rvd.RVD$$anonfun$apply$25$$anon$3.hasNext(RVD.scala:1266)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at scala.collection.Iterator$class.foreach(Iterator.scala:893)  
at scala.collection.AbstractIterator.foreach(Iterator.scala:1336)  
at is.hail.io.RichContextRDDRegionValue$$anonfun$25$$anonfun$apply$2$$anonfun$apply$3$$anonfun$apply$4.apply(RowStore.scala:1487)  
at is.hail.io.RichContextRDDRegionValue$$anonfun$25$$anonfun$apply$2$$anonfun$apply$3$$anonfun$apply$4.apply(RowStore.scala:1481)  
at is.hail.utils.package$.using(package.scala:587)  
at is.hail.io.RichContextRDDRegionValue$$anonfun$25$$anonfun$apply$2$$anonfun$apply$3.apply(RowStore.scala:1481)  
at is.hail.io.RichContextRDDRegionValue$$anonfun$25$$anonfun$apply$2$$anonfun$apply$3.apply(RowStore.scala:1479)  
at is.hail.utils.package$.using(package.scala:587)  
at is.hail.utils.richUtils.RichHadoopConfiguration$.writeFile$extension(RichHadoopConfiguration.scala:288)  
at is.hail.io.RichContextRDDRegionValue$$anonfun$25$$anonfun$apply$2.apply(RowStore.scala:1479)  
at is.hail.io.RichContextRDDRegionValue$$anonfun$25$$anonfun$apply$2.apply(RowStore.scala:1477)  
at is.hail.utils.package$.using(package.scala:587)  
at is.hail.io.RichContextRDDRegionValue$$anonfun$25.apply(RowStore.scala:1477)  
at is.hail.io.RichContextRDDRegionValue$$anonfun$25.apply(RowStore.scala:1475)  
at is.hail.utils.package$.using(package.scala:587)  
at is.hail.utils.richUtils.RichHadoopConfiguration$.writeFile$extension(RichHadoopConfiguration.scala:288)  
at is.hail.io.RichContextRDDRegionValue$.is$hail$io$RichContextRDDRegionValue$$writeSplitRegion$extension(RowStore.scala:1475)  
at is.hail.io.RichContextRDDRegionValue$$anonfun$23.apply(RowStore.scala:1428)  
at is.hail.io.RichContextRDDRegionValue$$anonfun$23.apply(RowStore.scala:1416)  
at is.hail.sparkextras.ContextRDD$$anonfun$cmapPartitionsWithIndex$1$$anonfun$apply$30.apply(ContextRDD.scala:369)  
at is.hail.sparkextras.ContextRDD$$anonfun$cmapPartitionsWithIndex$1$$anonfun$apply$30.apply(ContextRDD.scala:369)  
at is.hail.sparkextras.ContextRDD$$anonfun$run$1$$anonfun$apply$8.apply(ContextRDD.scala:149)  
at is.hail.sparkextras.ContextRDD$$anonfun$run$1$$anonfun$apply$8.apply(ContextRDD.scala:149)  
at scala.collection.Iterator$$anon$12.nextCur(Iterator.scala:434)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:440)  
at scala.collection.Iterator$class.foreach(Iterator.scala:893)  
at scala.collection.AbstractIterator.foreach(Iterator.scala:1336)  
at scala.collection.generic.Growable$class.$plus$plus$eq(Growable.scala:59)  
at scala.collection.mutable.ArrayBuffer.$plus$plus$eq(ArrayBuffer.scala:104)  
at scala.collection.mutable.ArrayBuffer.$plus$plus$eq(ArrayBuffer.scala:48)  
at scala.collection.TraversableOnce$class.to(TraversableOnce.scala:310)  
at scala.collection.AbstractIterator.to(Iterator.scala:1336)  
at scala.collection.TraversableOnce$class.toBuffer(TraversableOnce.scala:302)  
at scala.collection.AbstractIterator.toBuffer(Iterator.scala:1336)  
at scala.collection.TraversableOnce$class.toArray(TraversableOnce.scala:289)  
at scala.collection.AbstractIterator.toArray(Iterator.scala:1336)  
at org.apache.spark.rdd.RDD$$anonfun$collect$1$$anonfun$12.apply(RDD.scala:945)  
at org.apache.spark.rdd.RDD$$anonfun$collect$1$$anonfun$12.apply(RDD.scala:945)  
at org.apache.spark.SparkContext$$anonfun$runJob$5.apply(SparkContext.scala:2074)  
at org.apache.spark.SparkContext$$anonfun$runJob$5.apply(SparkContext.scala:2074)  
at org.apache.spark.scheduler.ResultTask.runTask(ResultTask.scala:87)  
at org.apache.spark.scheduler.Task.run(Task.scala:109)  
at org.apache.spark.executor.Executor$TaskRunner.run(Executor.scala:345)  
at java.util.concurrent.ThreadPoolExecutor.runWorker(ThreadPoolExecutor.java:1149)  
at java.util.concurrent.ThreadPoolExecutor$Worker.run(ThreadPoolExecutor.java:624)  
at java.lang.Thread.run(Thread.java:748)

java.io.IOException: error=2, No such file or directory  
at java.lang.UNIXProcess.forkAndExec(Native Method)  
at java.lang.UNIXProcess.(UNIXProcess.java:247)  
at java.lang.ProcessImpl.start(ProcessImpl.java:134)  
at java.lang.ProcessBuilder.start(ProcessBuilder.java:1029)  
at is.hail.utils.richUtils.RichIterator$.pipe$extension(RichIterator.scala:47)  
at is.hail.methods.VEP$$anonfun$7$$anonfun$apply$4.apply(VEP.scala:133)  
at is.hail.methods.VEP$$anonfun$7$$anonfun$apply$4.apply(VEP.scala:129)  
at scala.collection.Iterator$$anon$12.nextCur(Iterator.scala:434)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:440)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at scala.collection.Iterator$$anon$11.hasNext(Iterator.scala:408)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at scala.collection.Iterator$$anon$11.hasNext(Iterator.scala:408)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at is.hail.rvd.RVD$$anonfun$apply$25$$anon$3.hasNext(RVD.scala:1266)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at scala.collection.Iterator$$anon$11.hasNext(Iterator.scala:408)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at scala.collection.Iterator$$anon$11.hasNext(Iterator.scala:408)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at org.apache.spark.storage.memory.MemoryStore.putIteratorAsValues(MemoryStore.scala:216)  
at org.apache.spark.storage.BlockManager$$anonfun$doPutIterator$1.apply(BlockManager.scala:1094)  
at org.apache.spark.storage.BlockManager$$anonfun$doPutIterator$1.apply(BlockManager.scala:1085)  
at org.apache.spark.storage.BlockManager.doPut(BlockManager.scala:1020)  
at org.apache.spark.storage.BlockManager.doPutIterator(BlockManager.scala:1085)  
at org.apache.spark.storage.BlockManager.getOrElseUpdate(BlockManager.scala:811)  
at org.apache.spark.rdd.RDD.getOrCompute(RDD.scala:335)  
at org.apache.spark.rdd.RDD.iterator(RDD.scala:286)  
at org.apache.spark.rdd.MapPartitionsRDD.compute(MapPartitionsRDD.scala:49)  
at org.apache.spark.rdd.RDD.computeOrReadCheckpoint(RDD.scala:324)  
at org.apache.spark.rdd.RDD.iterator(RDD.scala:288)  
at org.apache.spark.rdd.MapPartitionsRDD.compute(MapPartitionsRDD.scala:49)  
at org.apache.spark.rdd.RDD.computeOrReadCheckpoint(RDD.scala:324)  
at org.apache.spark.rdd.RDD.iterator(RDD.scala:288)  
at org.apache.spark.rdd.MapPartitionsRDD.compute(MapPartitionsRDD.scala:49)  
at org.apache.spark.rdd.RDD.computeOrReadCheckpoint(RDD.scala:324)  
at org.apache.spark.rdd.RDD.iterator(RDD.scala:288)  
at org.apache.spark.rdd.MapPartitionsRDD.compute(MapPartitionsRDD.scala:49)  
at org.apache.spark.rdd.RDD.computeOrReadCheckpoint(RDD.scala:324)  
at org.apache.spark.rdd.RDD.iterator(RDD.scala:288)  
at is.hail.sparkextras.ContextRDD.iterator(ContextRDD.scala:546)  
at is.hail.sparkextras.RepartitionedOrderedRDD2$$anonfun$compute$1$$anonfun$apply$1.apply(RepartitionedOrderedRDD2.scala:60)  
at is.hail.sparkextras.RepartitionedOrderedRDD2$$anonfun$compute$1$$anonfun$apply$1.apply(RepartitionedOrderedRDD2.scala:59)  
at scala.collection.Iterator$$anon$12.nextCur(Iterator.scala:434)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:440)  
at scala.collection.Iterator$$anon$18.hasNext(Iterator.scala:764)  
at scala.collection.Iterator$$anon$13.hasNext(Iterator.scala:461)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at is.hail.io.RichContextRDDRegionValue$$anonfun$boundary$extension$1$$anon$1.hasNext(RowStore.scala:1301)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at scala.collection.Iterator$$anon$1.hasNext(Iterator.scala:1004)  
at is.hail.utils.richUtils.RichIterator$$anon$5.isValid(RichIterator.scala:22)  
at is.hail.utils.StagingIterator.isValid(FlipbookIterator.scala:48)  
at is.hail.utils.FlipbookIterator$$anon$9.setValue(FlipbookIterator.scala:331)  
at is.hail.utils.FlipbookIterator$$anon$9.(FlipbookIterator.scala:344)  
at is.hail.utils.FlipbookIterator.leftJoinDistinct(FlipbookIterator.scala:323)  
at is.hail.annotations.OrderedRVIterator.leftJoinDistinct(OrderedRVIterator.scala:62)  
at is.hail.rvd.KeyedRVD$$anonfun$6.apply(KeyedRVD.scala:88)  
at is.hail.rvd.KeyedRVD$$anonfun$6.apply(KeyedRVD.scala:88)  
at is.hail.rvd.KeyedRVD$$anonfun$orderedJoinDistinct$1.apply(KeyedRVD.scala:98)  
at is.hail.rvd.KeyedRVD$$anonfun$orderedJoinDistinct$1.apply(KeyedRVD.scala:95)  
at is.hail.sparkextras.ContextRDD$$anonfun$czipPartitions$1$$anonfun$apply$34.apply(ContextRDD.scala:416)  
at is.hail.sparkextras.ContextRDD$$anonfun$czipPartitions$1$$anonfun$apply$34.apply(ContextRDD.scala:416)  
at is.hail.sparkextras.ContextRDD$$anonfun$cmapPartitionsWithIndex$1$$anonfun$apply$30$$anonfun$apply$31.apply(ContextRDD.scala:369)  
at is.hail.sparkextras.ContextRDD$$anonfun$cmapPartitionsWithIndex$1$$anonfun$apply$30$$anonfun$apply$31.apply(ContextRDD.scala:369)  
at scala.collection.Iterator$$anon$12.nextCur(Iterator.scala:434)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:440)  
at is.hail.rvd.RVD$$anonfun$apply$25$$anon$3.hasNext(RVD.scala:1266)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at scala.collection.Iterator$$anon$11.hasNext(Iterator.scala:408)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at is.hail.rvd.RVD$$anonfun$apply$25$$anon$3.hasNext(RVD.scala:1266)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at scala.collection.Iterator$$anon$11.hasNext(Iterator.scala:408)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at is.hail.rvd.RVD$$anonfun$apply$25$$anon$3.hasNext(RVD.scala:1266)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:438)  
at scala.collection.Iterator$class.foreach(Iterator.scala:893)  
at scala.collection.AbstractIterator.foreach(Iterator.scala:1336)  
at is.hail.io.RichContextRDDRegionValue$$anonfun$25$$anonfun$apply$2$$anonfun$apply$3$$anonfun$apply$4.apply(RowStore.scala:1487)  
at is.hail.io.RichContextRDDRegionValue$$anonfun$25$$anonfun$apply$2$$anonfun$apply$3$$anonfun$apply$4.apply(RowStore.scala:1481)  
at is.hail.utils.package$.using(package.scala:587)  
at is.hail.io.RichContextRDDRegionValue$$anonfun$25$$anonfun$apply$2$$anonfun$apply$3.apply(RowStore.scala:1481)  
at is.hail.io.RichContextRDDRegionValue$$anonfun$25$$anonfun$apply$2$$anonfun$apply$3.apply(RowStore.scala:1479)  
at is.hail.utils.package$.using(package.scala:587)  
at is.hail.utils.richUtils.RichHadoopConfiguration$.writeFile$extension(RichHadoopConfiguration.scala:288)  
at is.hail.io.RichContextRDDRegionValue$$anonfun$25$$anonfun$apply$2.apply(RowStore.scala:1479)  
at is.hail.io.RichContextRDDRegionValue$$anonfun$25$$anonfun$apply$2.apply(RowStore.scala:1477)  
at is.hail.utils.package$.using(package.scala:587)  
at is.hail.io.RichContextRDDRegionValue$$anonfun$25.apply(RowStore.scala:1477)  
at is.hail.io.RichContextRDDRegionValue$$anonfun$25.apply(RowStore.scala:1475)  
at is.hail.utils.package$.using(package.scala:587)  
at is.hail.utils.richUtils.RichHadoopConfiguration$.writeFile$extension(RichHadoopConfiguration.scala:288)  
at is.hail.io.RichContextRDDRegionValue$.is$hail$io$RichContextRDDRegionValue$$writeSplitRegion$extension(RowStore.scala:1475)  
at is.hail.io.RichContextRDDRegionValue$$anonfun$23.apply(RowStore.scala:1428)  
at is.hail.io.RichContextRDDRegionValue$$anonfun$23.apply(RowStore.scala:1416)  
at is.hail.sparkextras.ContextRDD$$anonfun$cmapPartitionsWithIndex$1$$anonfun$apply$30.apply(ContextRDD.scala:369)  
at is.hail.sparkextras.ContextRDD$$anonfun$cmapPartitionsWithIndex$1$$anonfun$apply$30.apply(ContextRDD.scala:369)  
at is.hail.sparkextras.ContextRDD$$anonfun$run$1$$anonfun$apply$8.apply(ContextRDD.scala:149)  
at is.hail.sparkextras.ContextRDD$$anonfun$run$1$$anonfun$apply$8.apply(ContextRDD.scala:149)  
at scala.collection.Iterator$$anon$12.nextCur(Iterator.scala:434)  
at scala.collection.Iterator$$anon$12.hasNext(Iterator.scala:440)  
at scala.collection.Iterator$class.foreach(Iterator.scala:893)  
at scala.collection.AbstractIterator.foreach(Iterator.scala:1336)  
at scala.collection.generic.Growable$class.$plus$plus$eq(Growable.scala:59)  
at scala.collection.mutable.ArrayBuffer.$plus$plus$eq(ArrayBuffer.scala:104)  
at scala.collection.mutable.ArrayBuffer.$plus$plus$eq(ArrayBuffer.scala:48)  
at scala.collection.TraversableOnce$class.to(TraversableOnce.scala:310)  
at scala.collection.AbstractIterator.to(Iterator.scala:1336)  
at scala.collection.TraversableOnce$class.toBuffer(TraversableOnce.scala:302)  
at scala.collection.AbstractIterator.toBuffer(Iterator.scala:1336)  
at scala.collection.TraversableOnce$class.toArray(TraversableOnce.scala:289)  
at scala.collection.AbstractIterator.toArray(Iterator.scala:1336)  
at org.apache.spark.rdd.RDD$$anonfun$collect$1$$anonfun$12.apply(RDD.scala:945)  
at org.apache.spark.rdd.RDD$$anonfun$collect$1$$anonfun$12.apply(RDD.scala:945)  
at org.apache.spark.SparkContext$$anonfun$runJob$5.apply(SparkContext.scala:2074)  
at org.apache.spark.SparkContext$$anonfun$runJob$5.apply(SparkContext.scala:2074)  
at org.apache.spark.scheduler.ResultTask.runTask(ResultTask.scala:87)  
at org.apache.spark.scheduler.Task.run(Task.scala:109)  
at org.apache.spark.executor.Executor$TaskRunner.run(Executor.scala:345)  
at java.util.concurrent.ThreadPoolExecutor.runWorker(ThreadPoolExecutor.java:1149)  
at java.util.concurrent.ThreadPoolExecutor$Worker.run(ThreadPoolExecutor.java:624)  
at java.lang.Thread.run(Thread.java:748)

Hail version: 0.2.9-6f862a0873f5  
Error summary: IOException: error=2, No such file or directory

---

<div class="post-metadata">

**Author:** ![tpoterba](https://yyz2.discourse-cdn.com/flex036/user_avatar/discuss.hail.is/tpoterba/32/61_2.png) [@tpoterba](https://discuss.hail.is/u/tpoterba)\
**Post date:** [February 11, 2019, 4:09pm UTC](https://discuss.hail.is/t/cant-write-vep-annotated-hail-table/855/4 "2019-02-11T16:09:47Z")

</div>

the problem is here:

```auto
docker exec -d my_vep_run vep

```

Can you run this command on all the nodes of your cluster?

---

<div class="post-metadata">

**Author:** ![Jack-Ow](https://yyz2.discourse-cdn.com/flex036/user_avatar/discuss.hail.is/jack-ow/32/304_2.png) [@Jack-Ow](https://discuss.hail.is/u/Jack-Ow)\
**Post date:** [February 13, 2019, 8:46am UTC](https://discuss.hail.is/t/cant-write-vep-annotated-hail-table/855/5 "2019-02-13T08:46:36Z")

</div>

Yes, true. I’ve since changed install docker on all the nodes and start the to the below code. Then I test the  
"sudo docker exec -d new\_vep\_run vep` and it simply go to the next line and didn’t give me error.

for SLAVEIP in `sudo grep -i privateip /mnt/var/lib/info/*.txt | sort -u | cut -d "\"" -f 2`  
do  
ssh hadoop@{SLAVEIP} "sudo yum -y install docker" ssh hadoop@{SLAVEIP} “sudo service docker start”  
ssh hadoop@${SLAVEIP} “sudo docker run --name new\_vep\_run -d ensemblorg/ensembl-vep:release\_89.5 tail -f /dev/null”  
done
