查看: 3392|回复: 13

[讨论] o(1)的算法也许并不是最优化的……脚本语言太神奇了

[复制链接]

遠航の猫咪

梦石
3
星屑
26947
在线时间
2423 小时
注册时间
2005-10-15
回帖
987

开拓者

发表于 2018-1-16 14:59:35 | 显示全部楼层 |阅读模式

加入我们,或者,欢迎回来。

您需要 登录 才可以下载或查看,没有账号?注册会员

×
本帖最后由 SailCat 于 2018-1-16 15:12 编辑

ruby的1.81没有Array#sample

正在开发的插件,要大量的运用到sample操作,没办法,自己写一个

第一个版本:
[pre lang="ruby"]class Array
  # Implement sample for Ruby 1.9+
  def sample1(n=1)
    return self[rand(size)] if n == 1
    t = clone; n = [[n, size].min, 0].max; a = []
    n.times { a.push(t.slice!(rand(t.size)))}
    a
  end
end[/pre]
复杂度o(n!)

写出来就觉得slice!太粗暴了,o(n!)就是因为它,想改改

第二个版本:
[pre lang="ruby"]class Array
  # Implement sample for Ruby 1.9+
  def sample2(n=1)
    n == 1 ? self[rand(size)] : sort_by{rand(0)}[0...([[n, size].min, 0].max)]
  end
end[/pre]

这是个o(1)的算法,而且写法最简单,一行搞定
顺便说一下 sort_by{rand(0)}是我从sql的写法中得到的灵感,ruby1.81也没有shuffle,我用这个方法实现了shuffle

一般写成o(1)就觉得很好了,但我觉得哪怕取两个数也要把整个数组重排一遍太小题大作了

第三个版本:
每取一个数,就把最后一个数挪过来
[pre lang="ruby"]class Array
  # Implement sample for Ruby 1.9+
  def sample3(n=1)
    return self[rand(size)] if n == 1
    t = clone; n = [[n, size].min, 0].max; a = []
    n.times {|i| d = rand(size-i); a.push(t[d]); t[d] = t[size-1]}
    a
  end
end[/pre]

差不多了,但还是对push心有余悸,我不知道ruby的解释器是怎么实现变长数组的,但是还是想扔掉push

第四个版本:
取前n个数,随机和后面的数交换
[pre lang="ruby"]class Array
  # Implement sample for Ruby 1.9+
  def sample4(n=1)
    return self[rand(size)] if n == 1
    t = clone; n = [[n, size].min, 0].max
    n.times {|i| d = i + rand(size - i); tmp = t; t = t[d]; t[d] = t}
    t[0...n]
  end
end[/pre]

你们觉得哪个最优化?测试的结果可能和你们想的不一样哦。

测试代码和结果
[pre lang="ruby"]a = (1..100000).to_a
n = 100
t0 = Time.now
a.sample1(n)
t1 = Time.now
a.sample2(n)
t2 = Time.now
a.sample3(n)
t3 = Time.now
a.sample4(n)
t4 = Time.now
[/pre]


nsample1sample2sample3sample4
1000.0030.1710.0010.000
10000.0340.1740.0010.000
100000.3010.1750.0070.006
500001.0360.1670.0320.028
999991.5580.1610.0650.060




评分

参与人数 1赞 +1 收起 理由
tjjlb + 1 塞糖

查看全部评分

SailCat (小猫子·要开心一点) 共上站 24 次,发表过 11 篇文章 上 次 在: [2006年01月28日11:41:18 星期六] 从 [162.105.120.91] 到本站一游。
梦石
0
星屑
9292
在线时间
2504 小时
注册时间
2011-5-20
回帖
14521

开拓者

发表于 2018-1-16 15:01:38 | 显示全部楼层
這4種裏,1.9用的是哪一種···

点评

1.92用的是算法4,其中对n=0到10的情况做了另外的处理(就是硬算)  发表于 2018-1-16 15:34
http://ruby-doc.org/core-1.9.2/Array.html#method-sample  发表于 2018-1-16 15:14
[img]http://service.t.sina.com.cn/widget/qmd/5339802982/c02e16bd/7.png
回复

使用道具 举报

梦石
0
星屑
6891
在线时间
7027 小时
注册时间
2013-11-2
回帖
1263

开拓者剧作品鉴家

发表于 2018-1-16 15:19:50 | 显示全部楼层
1.png
大佬,你是不是完全无视了sort_by本身的复杂度和运行效率啊?

点评

放假之后的雷霆突然活跃起来~  发表于 2018-1-16 17:23
就sample本身处理的时长和所传入的参数n的关系来说,是o(1)啊……几次测试的时间也是恒定的>_<  发表于 2018-1-16 15:31
本人才疏学浅,还请大佬指点迷津。  发表于 2018-1-16 15:28
我针对的是标题。这哪儿o(1)了啊?  发表于 2018-1-16 15:24
我说了啊,取2个数要把全数组排一遍太麻烦了,语法糖毕竟只是语法糖……所以后面才写了算法3和4  发表于 2018-1-16 15:22
回复

使用道具 举报

梦石
0
星屑
1547
在线时间
688 小时
注册时间
2009-11-11
回帖
2692
发表于 2018-1-16 18:59:05 | 显示全部楼层
机器码是最快的了,代码运行中全部都翻译成0和1,最底层的最快,对于C来说是这样的,鬼知道rm进行了什么奇怪的处理

嘿。嘿。嘿
回复

使用道具 举报

梦石
0
星屑
4623
在线时间
1207 小时
注册时间
2016-4-7
回帖
944

开拓者

发表于 2018-1-17 09:05:57 | 显示全部楼层
最优化的当然是jeff的O(1/n)啦 越多越快

点评

笑死  发表于 2018-1-19 03:59
附庸的附庸不是我的附庸,女儿的女儿还是我的女儿。CK2沉迷ing
回复

使用道具 举报

梦石
0
星屑
1803
在线时间
133 小时
注册时间
2013-10-6
回帖
181
发表于 2018-1-19 04:00:34 | 显示全部楼层
复杂度不是这么看的...
←你看到一只经常潜水的萌新。
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 注册会员

本版积分规则

Powered by Discuz! X5.0 © 2001-2026 Discuz! Team.

在本版发帖返回顶部