V2EX = way to explore
V2EX 是一个关于分享和探索的地方
现在注册
已注册用户请  登录
• 外包信息请发到 /go/outsourcing 节点。
• 不要把相同的信息发到不同的节点
wanplus
V2EX  ›  酷工作

[北京立水桥][玩加赛事]爬虫工程师

  •  
  •   wanplus · 2017-12-21 14:32:20 +08:00 · 1912 次点击
    这是一个创建于 2535 天前的主题,其中的信息可能已经有所发展或是发生改变。
    职位描述:

    1. 负责多平台、大规模信息爬取和爬取内容的提取、清洗、落地、分析;
    2. 参与爬虫系统的架构设计和研发,以及性能优化;
    3. 抓取策略算法的更新维护,以及确保数据抽取准确、高效。

    职位要求:

    1. 理解 HTTP 协议,熟悉 HTML、DOM、XPath、熟悉浏览器内核、渲染机制;
    2. 熟悉 Linux 开发环境,至少熟悉 Python/Go/Java/Node.js 中的一种编程语言;
    3. 有爬虫、信息抽取、文本分类、大数据处理相关经验优先;
    4. 有自然语言处理、机器学习经验优先。

    薪资范围 15-30K 简历接收邮件: [email protected]
    1 条回复    2017-12-25 19:03:59 +08:00
    wanplus
        1
    wanplus  
    OP
       2017-12-25 19:03:59 +08:00
    ~~
    关于   ·   帮助文档   ·   博客   ·   API   ·   FAQ   ·   实用小工具   ·   2688 人在线   最高记录 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 21ms · UTC 05:15 · PVG 13:15 · LAX 21:15 · JFK 00:15
    Developed with CodeLauncher
    ♥ Do have faith in what you're doing.