2017 年 GitHub 中 Top 30 开源机器学习项目

本贴最后更新于 2045 天前,其中的信息可能已经时移俗易

转载自_https://medium.mybridge.co/30-amazing-machine-learning-projects-for-the-past-year-v-2018-b853b8621ac7_

Mybridge 精选的 Top 30 项目及源码链接如下:

NO1 **** FastText:快速文本表示和文本分类库

在 Github 已获得 11995 颗星,贡献者 Facebook Research。

源码链接:

NO2 **** ****Deep-photo-styletransfer:“Deep Photo Style Transfer” 论文的源码和数据

在 Github 已获得 9747 颗星,论文来自于康奈尔大学的 Fujun Luan。

源码链接:

NO3 **** ********用 Python 和命令行来实现的最简单的面部识别 API

在 Github 已获得 8672 颗星,贡献者 Adam Geitge。

源码链接:

https://github.com/ageitgey/face_recognition

**NO4 ** **** ****Magenta:利用机器智能生成音乐和美术艺术品

在 Github 已获得 8113 颗星,贡献者 tensorflow。

源码链接:

https://github.com/tensorflow/magenta

NO5 **** ****Sonnet:基于 TensorFlow 的神经网络库

在 Github 已获得 573 颗星,贡献者是 DeepMind 的 Malcolm Reynolds。

源码链接:

https://github.com/deepmind/sonnet

NO6 **** ****deeplearn.js: 一个用于 Web 的硬件加速机器学习库

GitHub 5462 颗星,贡献者是 Google Brain 的 Nikhil Thorat。

源码链接:

https://github.com/PAIR-code/deeplearnjs

NO7 **** ****基于 TensorFlow 的快速风格迁移库

GitHub 4843 颗星,贡献者是 MIT 的 Logan Engstrom。

源码链接:

https://github.com/lengstrom/fast-style-transfer

NO8 **** ****Pysc2: 星际争霸 2 学习环境

GitHub 3684 颗星,贡献者是 DeepMind 的 Timo Ewalds。

源码链接:

https://github.com/deepmind/pysc2

NO9 **** ******AirSim: Microsoft AI & Research 开源的基于虚幻引擎的开源模拟器,**用于自动驾驶

GitHub 3861 颗星,贡献者是 Microsoft 的 Shital Shah。

源码链接:

https://github.com/Microsoft/AirSim

NO10 **** ****acets: 机器学习数据集的可视化工具

GitHub 3371 颗星,由 Google Brain 贡献。

源码链接:

https://github.com/PAIR-code/facets

NO11 **** ****Style2Paints:用 AI 技术为线稿快速上色的工具

GitHub 3310 颗星,贡献者 lllyasviel 。

源码链接:

NO12 **** ****Tensor2Tensor:用于广义序列-序列模型的库—Google Research

GitHub 3087 颗星,贡献者是 Google Brain 的 Ryan Sepassi。

源码链接:

https://github.com/tensorflow/tensor2tensor

NO13 **** ****基于 Pytorch 实现的图片-图片转换

GitHub 2847 颗星,贡献者 Berkeley 的 Jun-Yan Zhu, Ph.D。

源码地址:

https://github.com/junyanz/pytorch-CycleGAN-and-pix2pix

NO14Faiss:用于密集向量的高效相似性搜索库和聚类的库

GitHub 2629 颗星,贡献者 Facebook Research。

源码地址:

https://github.com/facebookresearch/faiss

NO15****Fashion-minist:类似于 MNIST 的时尚产品数据集

GitHub 2780 颗星,贡献者是 Zalando Tech 的 Han Xiao。

源码链接:

https://github.com/zalandoresearch/fashion-mnist

NO16****ParlAI:可用在各种公开可用的对话数据集上训练和评估 AI 模型的框架

GitHub 2578 颗星,贡献者是 Facebook 的 Alexander Miller。

源码链接:

https://github.com/facebookresearch/ParlAI

NO17****Fairseq:Facebook AI Research 的序列—序列工具包

GitHub 2571 颗星,由 facebookresearch 贡献。

源码链接:

https://github.com/facebookresearch/fairseq

NO18****Pyro:基于 Python 和 PyTorch 的深度通用概率编程

GitHub 2387 颗星,贡献者 Uber Engineering。

源码链接:

https://github.com/uber/pyro

NO19****iGAN:基于 GAN 的交互式图像生成

GitHub 2369 颗星,贡献者 junyanz。

源码地址:

https://github.com/junyanz/iGAN

NO20****Deep-image-prior:用神经网络恢复图像

GitHub 2188 颗星,贡献者是 Skoltech 的 Dmitry Ulyanov, Ph.D。

源码地址:

https://github.com/DmitryUlyanov/deep-image-prior

NO21****人脸分类:基于 Keras CNN 模型与 OpenCV,使用 fer2013/imdb 数据集进行实时面部检测和表情/性别分类

GitHub 1967 颗星,由 oarriaga 贡献。

源码地址:

https://github.com/oarriaga/face_classification

NO22****Speech-to-Text-WaveNet:使用 DeepMind 的 WaveNet 和 TensorFlow 进行端到端句级英语语音识别

GitHub 1961 颗星,贡献者是 Kakao Brain 的 Namju Kim。

源码地址:

https://github.com/buriburisuri/speech-to-text-wavenet

NO23****StarGAN: 用于多域图像-图像转化的统一生成对抗网络

GitHub 1954 颗星,贡献者 Korea University 的 Yunjey Choi。

源码地址:

https://github.com/yunjey/StarGAN

NO24****MI-agents:Unity 机器学习代理

GitHub 1658 颗星,贡献者 Unity3D 的 Arthur Juliani。

源码地址:

NO25****DeepVideoAnalytics:一个分布式可视化搜索和数据分析平台

GitHub 1494 颗星,贡献者是 Cornell University 的 Akshay Bhat。

源码地址:

https://github.com/AKSHAYUBHAT/DeepVideoAnalytics

NO26****OpenNMT:Torch 上的开源神经机器翻译工具包

GitHub 1490 颗星,贡献者 OpenNMT。

源码地址:

https://github.com/OpenNMT/OpenNMT

NO27****Pix2pixHD: 用条件 GAN 合成和处理 2048×1024 的图像

GitHub 1283 颗星,贡献者是英伟达科学家 Ming-Yu Liu。

源码地址:

https://github.com/NVIDIA/pix2pixHD

NO28****Horovod:TensorFlow 布式训练框架

GitHub 1188 颗星,贡献者来自 Uber。

源码地址:

https://github.com/uber/horovod

NO29** **** **AI-Blocks:任意用户都可创建机器学习模型

GitHub 899 颗星,贡献者 MrNothing。

源码地址:

https://github.com/MrNothing/AI-Blocks

NO30 **** ****Tensorflow 实现的用于语音风格转换的深度神经网络

GitHub 845 颗星,贡献者是 Kakao Brain AI 团队的 Dabi Ahn。

源码地址:

https://github.com/andabi/deep-voice-conversion

  • 机器学习

    机器学习(Machine Learning)是一门多领域交叉学科,涉及概率论、统计学、逼近论、凸分析、算法复杂度理论等多门学科。专门研究计算机怎样模拟或实现人类的学习行为,以获取新的知识或技能,重新组织已有的知识结构使之不断改善自身的性能。

    76 引用 • 37 回帖
  • 人工智能

    人工智能(Artificial Intelligence)是研究、开发用于模拟、延伸和扩展人的智能的理论、方法、技术及应用系统的一门技术科学。

    77 引用 • 159 回帖

相关帖子

欢迎来到这里!

我们正在构建一个小众社区,大家在这里相互信任,以平等 • 自由 • 奔放的价值观进行分享交流。最终,希望大家能够找到与自己志同道合的伙伴,共同成长。

注册 关于
请输入回帖内容 ...

推荐标签 标签

  • 面试

    面试造航母,上班拧螺丝。多面试,少加班。

    324 引用 • 1395 回帖
  • ZeroNet

    ZeroNet 是一个基于比特币加密技术和 BT 网络技术的去中心化的、开放开源的网络和交流系统。

    1 引用 • 21 回帖 • 609 关注
  • WebComponents

    Web Components 是 W3C 定义的标准,它给了前端开发者扩展浏览器标签的能力,可以方便地定制可复用组件,更好的进行模块化开发,解放了前端开发者的生产力。

    1 引用 • 4 关注
  • 安装

    你若安好,便是晴天。

    131 引用 • 1184 回帖
  • Python

    Python 是一种面向对象、直译式电脑编程语言,具有近二十年的发展历史,成熟且稳定。它包含了一组完善而且容易理解的标准库,能够轻松完成很多常见的任务。它的语法简捷和清晰,尽量使用无异义的英语单词,与其它大多数程序设计语言使用大括号不一样,它使用缩进来定义语句块。

    536 引用 • 672 回帖
  • 负能量

    上帝为你关上了一扇门,然后就去睡觉了....努力不一定能成功,但不努力一定很轻松 (° ー °〃)

    88 引用 • 1234 回帖 • 442 关注
  • IBM

    IBM(国际商业机器公司)或万国商业机器公司,简称 IBM(International Business Machines Corporation),总公司在纽约州阿蒙克市。1911 年托马斯·沃森创立于美国,是全球最大的信息技术和业务解决方案公司,拥有全球雇员 30 多万人,业务遍及 160 多个国家和地区。

    16 引用 • 53 回帖 • 131 关注
  • Latke

    Latke 是一款以 JSON 为主的 Java Web 框架。

    70 引用 • 533 回帖 • 735 关注
  • SEO

    发布对别人有帮助的原创内容是最好的 SEO 方式。

    35 引用 • 200 回帖 • 30 关注
  • 分享

    有什么新发现就分享给大家吧!

    245 引用 • 1776 回帖
  • C++

    C++ 是在 C 语言的基础上开发的一种通用编程语言,应用广泛。C++ 支持多种编程范式,面向对象编程、泛型编程和过程化编程。

    106 引用 • 152 回帖
  • 创造

    你创造的作品可能会帮助到很多人,如果是开源项目的话就更赞了!

    175 引用 • 994 回帖
  • frp

    frp 是一个可用于内网穿透的高性能的反向代理应用,支持 TCP、UDP、 HTTP 和 HTTPS 协议。

    16 引用 • 7 回帖 • 1 关注
  • FreeMarker

    FreeMarker 是一款好用且功能强大的 Java 模版引擎。

    23 引用 • 20 回帖 • 429 关注
  • Java

    Java 是一种可以撰写跨平台应用软件的面向对象的程序设计语言,是由 Sun Microsystems 公司于 1995 年 5 月推出的。Java 技术具有卓越的通用性、高效性、平台移植性和安全性。

    3169 引用 • 8208 回帖
  • Logseq

    Logseq 是一个隐私优先、开源的知识库工具。

    Logseq is a joyful, open-source outliner that works on top of local plain-text Markdown and Org-mode files. Use it to write, organize and share your thoughts, keep your to-do list, and build your own digital garden.

    5 引用 • 62 回帖
  • VirtualBox

    VirtualBox 是一款开源虚拟机软件,最早由德国 Innotek 公司开发,由 Sun Microsystems 公司出品的软件,使用 Qt 编写,在 Sun 被 Oracle 收购后正式更名成 Oracle VM VirtualBox。

    10 引用 • 2 回帖 • 7 关注
  • NetBeans

    NetBeans 是一个始于 1997 年的 Xelfi 计划,本身是捷克布拉格查理大学的数学及物理学院的学生计划。此计划延伸而成立了一家公司进而发展这个商用版本的 NetBeans IDE,直到 1999 年 Sun 买下此公司。Sun 于次年(2000 年)六月将 NetBeans IDE 开源,直到现在 NetBeans 的社群依然持续增长。

    78 引用 • 102 回帖 • 646 关注
  • ZooKeeper

    ZooKeeper 是一个分布式的,开放源码的分布式应用程序协调服务,是 Google 的 Chubby 一个开源的实现,是 Hadoop 和 HBase 的重要组件。它是一个为分布式应用提供一致性服务的软件,提供的功能包括:配置维护、域名服务、分布式同步、组服务等。

    59 引用 • 29 回帖 • 9 关注
  • 百度

    百度(Nasdaq:BIDU)是全球最大的中文搜索引擎、最大的中文网站。2000 年 1 月由李彦宏创立于北京中关村,致力于向人们提供“简单,可依赖”的信息获取方式。“百度”二字源于中国宋朝词人辛弃疾的《青玉案·元夕》词句“众里寻他千百度”,象征着百度对中文信息检索技术的执著追求。

    63 引用 • 785 回帖 • 237 关注
  • Netty

    Netty 是一个基于 NIO 的客户端-服务器编程框架,使用 Netty 可以让你快速、简单地开发出一个可维护、高性能的网络应用,例如实现了某种协议的客户、服务端应用。

    49 引用 • 33 回帖 • 20 关注
  • HBase

    HBase 是一个分布式的、面向列的开源数据库,该技术来源于 Fay Chang 所撰写的 Google 论文 “Bigtable:一个结构化数据的分布式存储系统”。就像 Bigtable 利用了 Google 文件系统所提供的分布式数据存储一样,HBase 在 Hadoop 之上提供了类似于 Bigtable 的能力。

    17 引用 • 6 回帖 • 60 关注
  • 创业

    你比 99% 的人都优秀么?

    83 引用 • 1398 回帖
  • 持续集成

    持续集成(Continuous Integration)是一种软件开发实践,即团队开发成员经常集成他们的工作,通过每个成员每天至少集成一次,也就意味着每天可能会发生多次集成。每次集成都通过自动化的构建(包括编译,发布,自动化测试)来验证,从而尽早地发现集成错误。

    14 引用 • 7 回帖 • 4 关注
  • Markdown

    Markdown 是一种轻量级标记语言,用户可使用纯文本编辑器来排版文档,最终通过 Markdown 引擎将文档转换为所需格式(比如 HTML、PDF 等)。

    165 引用 • 1474 回帖
  • 正则表达式

    正则表达式(Regular Expression)使用单个字符串来描述、匹配一系列遵循某个句法规则的字符串。

    31 引用 • 94 回帖 • 2 关注
  • 又拍云

    又拍云是国内领先的 CDN 服务提供商,国家工信部认证通过的“可信云”,乌云众测平台认证的“安全云”,为移动时代的创业者提供新一代的 CDN 加速服务。

    21 引用 • 37 回帖 • 523 关注