<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<oembed>
  <author_name>taka_maenishi</author_name>
  <author_url>https://blog.hatena.ne.jp/taka_maenishi/</author_url>
  <blog_title>MicroAd Developers Blog</blog_title>
  <blog_url>https://developers.microad.co.jp/</blog_url>
  <categories>
    <anon>Apache Hadoop</anon>
    <anon>Digdag</anon>
    <anon>Parquet</anon>
    <anon>Apache Hive</anon>
    <anon>データ基盤</anon>
  </categories>
  <description>はじめまして。サーバサイドエンジニアの前西と申します。主にETL処理*1のバッチ開発を行っています。 マイクロアドでは、広告配信ログやアクセスログなどのデータを元にして、様々な加工を行った上で蓄積を行なっています。 今回の記事では、私が普段業務で扱っているデータの蓄積処理について、生ログが加工されてデータの利用者側へと渡るまでの流れをご紹介できればと思います。 データ基盤 以前の記事でも紹介されていますが、マイクロアドではデータ基盤にHadoopを利用しています。 developers.microad.co.jp 下図のように、Kafkaに集約された数TB規模の広告配信ログ・アクセスログはFl…</description>
  <height>190</height>
  <html>&lt;iframe src=&quot;https://hatenablog-parts.com/embed?url=https%3A%2F%2Fdevelopers.microad.co.jp%2Fentry%2F2020%2F06%2F03%2F182343&quot; title=&quot;マイクロアドのログ蓄積の流れ - MicroAd Developers Blog&quot; class=&quot;embed-card embed-blogcard&quot; scrolling=&quot;no&quot; frameborder=&quot;0&quot; style=&quot;display: block; width: 100%; height: 190px; max-width: 500px; margin: 10px 0px;&quot;&gt;&lt;/iframe&gt;</html>
  <image_url>https://cdn-ak.f.st-hatena.com/images/fotolife/t/taka_maenishi/20200603/20200603184736.png</image_url>
  <provider_name>Hatena Blog</provider_name>
  <provider_url>https://hatena.blog</provider_url>
  <published>2020-06-03 18:23:43</published>
  <title>マイクロアドのログ蓄積の流れ</title>
  <type>rich</type>
  <url>https://developers.microad.co.jp/entry/2020/06/03/182343</url>
  <version>1.0</version>
  <width>100%</width>
</oembed>
