我如何才能快速和所有的数字在一个文件?

我有一个包含数千个数字的文件，每个数字都在自己的行上:

我想写一个脚本，它将打印文件中所有数字的总和。我有一个解决办法，但不是很有效。(运行需要几分钟。)我在寻找一个更有效的解决方案。有什么建议吗?

当前回答

在shell中使用awk，我使用下面的脚本来这样做:

    #!/bin/bash


total=0;

for i in $( awk '{ print $1; }' <myfile> )
do
 total=$(echo $total+$i | bc )
 ((count++))
done
echo "scale=2; $total " | bc

2020-03-29 07:48:34

其他回答

sed ':a;N;s/\n/+/;ta' file|bc

2010-04-24 02:32:53

这是直接的Bash:

sum=0
while read -r line
do
    (( sum += line ))
done < file
echo $sum

2010-04-24 01:04:36

Ruby:

ruby -e "File.read('file.txt').split.inject(0){|mem, obj| mem += obj.to_f}"

2014-05-11 01:12:07

只是为了好玩，让我们用PDL (Perl的数组数学引擎)来做!

perl -MPDL -E 'say rcols(shift)->sum' datafile

rcols将列读入矩阵(在本例中为1D)， sum (surprise)对矩阵中的所有元素求和。

2013-02-23 19:55:21

为了好玩，让我们对其进行基准测试:

$ for ((i=0; i<1000000; i++)) ; do echo $RANDOM; done > random_numbers

$ time perl -nle '$sum += $_ } END { print $sum' random_numbers
16379866392

real    0m0.226s
user    0m0.219s
sys     0m0.002s

$ time awk '{ sum += $1 } END { print sum }' random_numbers
16379866392

real    0m0.311s
user    0m0.304s
sys     0m0.005s

$ time { { tr "\n" + < random_numbers ; echo 0; } | bc; }
16379866392

real    0m0.445s
user    0m0.438s
sys     0m0.024s

$ time { s=0;while read l; do s=$((s+$l));done<random_numbers;echo $s; }
16379866392

real    0m9.309s
user    0m8.404s
sys     0m0.887s

$ time { s=0;while read l; do ((s+=l));done<random_numbers;echo $s; }
16379866392

real    0m7.191s
user    0m6.402s
sys     0m0.776s

$ time { sed ':a;N;s/\n/+/;ta' random_numbers|bc; }
^C

real    4m53.413s
user    4m52.584s
sys 0m0.052s

5分钟后，我中止了sed运行

我一直在lua潜水，速度很快:

$ time lua -e 'sum=0; for line in io.lines() do sum=sum+line end; print(sum)' < random_numbers
16388542582.0

real    0m0.362s
user    0m0.313s
sys     0m0.063s

当我更新这个的时候，ruby:

$ time ruby -e 'sum = 0; File.foreach(ARGV.shift) {|line| sum+=line.to_i}; puts sum' random_numbers
16388542582

real    0m0.378s
user    0m0.297s
sys     0m0.078s

听从埃德·莫顿的建议:使用1美元

$ time awk '{ sum += $1 } END { print sum }' random_numbers
16388542582

real    0m0.421s
user    0m0.359s
sys     0m0.063s

Vs使用$0

$ time awk '{ sum += $0 } END { print sum }' random_numbers
16388542582

real    0m0.302s
user    0m0.234s
sys     0m0.063s

2013-08-22 13:46:04

我如何才能快速和所有的数字在一个文件?

推荐文章

最新文章

标签