1 N0 i, C5 t9 B; _: ^, _理由一,本队的论文具有一些其他参赛模型所不具有的创新性:开放式分类。8 A: a5 Y3 `4 x; W! T- V
+ g+ E: d1 K% r# Z) Y8 c6 P$ a4 G / c" X* v/ ?: S, `! a& g1 u2 e: z
. V1 ]' L/ f3 {( I1 r' x
正如B题题目中所陈述的那样,现有分类类别“有的类别之间关系不清楚,造成混乱;有的类别过度粗略或精细;有的类别标签没有得到公认;有的音乐归属则存在争议或者难以划归。”这就要求我们不仅要提出分类方法,更重要的是提出一种科学的分类类别,并且能够为应用于推荐系统等方面埋下伏笔。4 H* Z# x. q5 G# B1 T. }9 u
& ^+ `* v% J: A# x; C" D8 c* E u
: ~3 ~4 p9 V5 ]1 b+ x* V' y! G
& T) d+ S( m5 l" ^
为了契合题意,我们队建立的几个模型,皆是为了面向推荐系统、打破传统风格分类界限而建立。 6 M5 F9 c C! T0 `3 Y, X # W$ W# N% p4 f g ! R! @8 U$ g/ Q# `" Q
* [. K4 D+ U% u/ U! P, f' k 为了跳出传统风格分类(包括情感,文本,风格等)的不足,隐含在我们论文当中的思想是:“重估一切分类”。换句话说:最科学的分类类别,就是没有分类类别。可能这一观点多少有些令人困惑。然而,换一个角度,我们能够更好地理解这个思想。如果我们能提出一种分类方法,使得该方法不依赖于任何先验的类别信息(风格,情感,标签,或者任何你能想到的一切),那么就做到了“最好的分类类别,就是没有分类类别”。为了部分地做到这一点,我们通过无监督的分类模型(SOM神经网络)、分形维数模型、用户行为核密度估计模型来达到这一点。我们的分类方法撇开了现有分类的拐杖(如风格、感情、流派),同时加入了用户的行为信息,并且通过实证数据进行了初步验证。这无疑在网络电台推荐领域有着更好的应用前景。 ; d) {& T+ O1 s. H1 J" G1 R& C, E C5 e) T/ z+ M5 B
0 R' | m, {, @# V4 G
) N0 O& v5 E1 D# O' S8 k/ Y 而纵观其他参赛模型,几乎全部都是利用现有的类别(如风格和情感),然后在特征提取(如标签,音频特征,语义特征等)和分类方法上(BP,小波,SVM,GMM,蜂群算法等)做文章。我们可以发现,在前人的工作中,这类成果已经较为广泛和完善,可以直接使用而无需经过新的思考。如果对这些方法进行机械组合,那么我们得到的结果是没有太多实用价值的,如对于网络电台推荐性能的提高和音乐市场分析、大众音乐审美等进一步应用没有太大指导作用。以较有代表性的特等奖2854队作品为例,其模型三(基于LDA和SVM的分类方法)是基于现有的古典/流行/摇摆/爵士四类风格进行多分类,这并没有突破传统风格类别的界限;在当今这样一个音乐类别关系错综繁杂,且新生类别层出不穷的时代,这样即使分类正确率再高,对于网络电台的推荐也没有太多指导意义。其在模型四中,该论文虽然发现了分形维数这一个创新点,但目光依然局限于传统风格分类,没有发掘分形维数可以打破传统风格分类的潜质。0 u, a% @% n9 P0 f& ^" |& A, V
( V/ Q0 \" Q! ~# j# t" y
: a- x5 ^- g u3 }8 y2 o
; j; h' B* ~: r* e) k- D, s
正如以上提到的特等奖论文一样,绝大多数论文都没有考虑打破传统风格界限,也没有考虑来自于用户方面的信息。这样的成果虽然在理论上有着一定的重要性,但在实际应用中只能拘泥并巩固传统分类,这多少违背了B题的初衷。我们组的亮点是勇于打破传统,迈出开放性分类的第一步,这与B题的要求十分契合,也与本赛事鼓励创新的初衷相一致,所以理应有更好的成绩。 1 n9 {: q' N! ?1 B1 R1 Q' b: Z a' ^: g) L
7 {6 D% B+ L' M6 @( j" ` d4 q4 k% J6 R
. {# Y: B% K0 z" Z! B/ H; p. Z 1 R/ t3 J$ a' n2 K' t理由二,本组模型专注于面向应用,“接地气”,考虑了用户的行为信息,为网络电台的推荐等应用埋下了伏笔,有着近一步研究应用的可能性。, ]0 I, x: K' U9 l
4 |: `' P( G7 n5 G: f% K# a
我们认为,音乐分类不能脱离人类的欣赏而独立存在。对于一个音乐作品,每个听众的理解是不同的。在我们需要综合考虑一下两点:& y1 Q+ j% @% b! d8 H" A
# T6 x+ ]+ [8 g1,音乐自身的特征; + f0 q( _2 _7 ^5 p ( c- X. h) P! \2,特定听众的音乐鉴赏行为特征。% {8 o: d' x" K2 n2 k
' F, H* Q4 ] u2 r" g u
针对以上两点,我们建立了音频指纹和用户指纹的概念。可能由于时间紧迫和数据不够,这两个概念的应用价值难以被发现。由此,我们组在赛后也在着手建立相应的推荐系统。另外,在音乐市场分析和音乐审美分析的应用也是显而易见的。(如,针对各年代人气音乐的分形维数,可以绘制随音乐史变迁的分形维数变化,分析大众音乐审美倾向;通过用户指纹的变化,可以分析音乐市场的新动向,等等)。这些都是机械分类所无法达到的。& Y' l. p1 T7 T) H& F3 N
& p+ h9 t) l' q
: `8 ~8 `' i. x: Y( m; V0 n
6 ~% ^: I+ `6 c- x5 a 此外,评语中谈到“考虑不够周全”。若这里的“不周全”是指音乐的外部信息考虑不周,那么事实上,针对音乐内部信息与外部信息的关系,我们在文中也进行了相应分析,可见论文第18~19页。我们的结论是,在实际应用中,音乐的内部信息往往才是主要矛盾。因此在模型中未有涉及情感、文本、标签等外部信息,也为情理之中。 p3 s0 b9 D: Z. _. N
7 Z" w$ t7 Z" {. x6 y, x
# O0 e1 {( I' @7 @- q3 }! T! u* V9 D# {. c. }0 ^2 ]3 b3 S
8 k. C' w! z' b: i; \4 l
+ O ^7 N5 U: S. J6 `. A- Q. U& Q 综上所述,我们认为,尽管我们的论文有很多不足,模型也并不复杂,论述也稍显粗糙,但本组论文勇于打破传统,迈出开放性分类的第一步,并且面向推荐系统,考虑实际应用,这与B题的要求十分契合,也与本赛事鼓励创新的初衷相一致。与其他参赛队的论文相比,理应有更好的成绩。希望组委会和专家评审们能够再一次重新评估,给出更详细的建议。同时,这也可进一步宣传推广“认证杯”数学建模比赛。希望我们小小的意见能够被组委会考虑。若能如此,我们将不胜感激。再次表示感谢! 8 b1 O* B3 `9 W , T2 J: N' c2 W7 `$ t+ T% K' m " X% M2 i0 _/ a9 `4 [. o) E 2 A, n9 J7 a; D4 O" a. D 9 f. v( Y. J# t! g8 Y% x" ? 8 O \+ w) \# g 参赛队1009 : `7 |, `3 d" W3 L, r2 [( `! [作者: 友达 时间: 2013-5-13 11:48
很有想法,顶!