「ビッグデータ」に関連する技術ブログ - TECH PLAY

TECH PLAY

ビッグデータ」に関連する技術ブログ

339 件中 1 - 15 件目
本記事は 2026 年 6 月 25 日から 26 日に幕張メッセで開催された AWS Summit Japan 2026 の開催報告です。AWS for Industries Zone に出展した株式会社 SUMCO のブース展示 「Amazon Redshift × 生成 AI で挑む 半導体ウェーハメーカーの DX」 の内容を、SUMCO と AWS が共同で振り返ります。 図 1: AWS Summit Japan 2026 の SUMCO ブース。実物の 300mm シリコンウェーハとともに、生
本記事は 2026 年 3 月 23 日 に公開された「 Extract data from Amazon Aurora MySQL to Amazon S3 Tables in Apache Iceberg format 」を翻訳したものです。 Amazon Aurora MySQL-Compatible Edition でデータを管理していて、分析や機械学習 (ML)、サービス横断のクエリに活用できるモダンなレイクハウス形式で利用可能にしたい、という方は多いのではないでしょうか。 組織では分析の実行、
本記事は 2026 年 8 月 11 日 に公開された「 How GPU acceleration builds billion-scale vector indexes on Amazon OpenSearch Service 」を翻訳したものです。 生成 AI アプリケーションが急速に増えるなか、いまの検索には高性能なベクトルインデックス作成とスケーラビリティが求められます。データセットが数十億件規模に達すると、従来の CPU ベースのインデックス作成がボトルネックになりがちで、生産性やイノベーション
はじめに データマネジメントPF統括部の平尾です。 大規模・長時間のバッチ処理を実行する時、AWS(EC2)の利用料は高額になりやすいです。 コスト削減策として、AWSの未使用EC2キャパシティ(AWSが各リージョン内のAZごとに提供できる、インスタンスタイプ別のコンピュートリソース量)を低コストで利用できるスポットインスタンスの活用を検討することが多いと思います。 一方で、AWS側のキャパシティ状況によってインスタンスが中断される可能性があるため、特に大規模・長時間の処理への適用が難しいという特性があり
はじめに こんにちは。NTTデータでデータサイエンティストを務めております@tamurayuc20ndです。 本記事では、DataRobot社が提供するAIアクセラレータの一つである「MLflowエクスペリメントの追跡」を題材に、PapermillによるNotebookの自動実行と、MLflowによる実験管理の仕組みを解説します。 単にテンプレートを動かすだけではなく、自分のユースケースに合わせてどこを修正すればよいかという観点で整理している点が本記事の主眼です。 Notebookベースで機械学習の試行錯
はじめに こんにちは。社内でデータサイエンティストを務めております@tomoberです。 NTTデータ ソリューション事業本部では、お客様企業のAI・データ活用を、コンサルティングから基盤構築、実行支援を通じた成果創出までワンストップで提供しており、その支援テクノロジーの一つとしてDataRobotを提供しております。 今回は、2026年1月に開催したデータで読み解く顧客行動セミナーでご紹介させていただいた内容を元に、なぜ顧客理解が必要かといった基本的な概念や、代表的な手法とその考え方を中心にご紹介します
みなさん、こんにちは。ソリューションアーキテクトの西村です。 今週も 週刊AWS をお届けします。 さて、7月28日(火)に東京・赤坂インターシティにて、「 AWS Bedrock LLM Day Japan 」が開催されます。Anthropic や OpenAI、OSS の最新モデルから、先日の AWS Summit New York での発表まで、生成 AI の最新動向を半日で体験いただけるイベントです。Amazon Bedrock を活用してビジネスにイノベーションを起こされているユーザーの事例セッ
数回前の号で、スタートアップと仕事をすることがどれほど活力になるかについて書きました。2026 年 6 月 29 日週、それを改めて感じました。AWS スタートアップチームと数日過ごし、創業者たちが実際に解決しようとしている問題について語る話に耳を傾けたのです。私の心に残った話の 1 つは、眼科医療へのアクセスを拡大しているブラジルのヘルステック企業 EyeCare Health の創業者である Marco Negreiros 氏から聞いたものです。彼は驚くべき事実を明かしました。ブラジルの自治体の 70
はじめに はじめまして!慶應義塾大学環境情報学部3年の上野 大和です!2026年の4月の1ヶ月間、C ...
はじめに 近年、企業活動におけるデータ活用の重要性はますます高まっています。 データ分析やAI活用など、企業活動のさまざまな場面でデータが使われるようになりました。 一方で、データを有効に活用するには、単に大量のデータを集めるだけでは不十分です。 冷蔵庫に食材をたくさん詰め込んでも、何がどこにあるのか、いつ買ったものなのか、まだ食べられるのかが分からなければ、安心して料理に使えません。データも同じです。 データがどこにあり、どのような意味を持ち、誰が管理し、どのような品質状態にあるのかを把握できてはじめて
本記事は 2025 年 9 月 22 日 に公開された「 A scalable, elastic database and search solution for 1B+ vectors built on LanceDB and Amazon S3 」を翻訳したものです。 この記事は Metagenomi の Owen Janson、Audra Devoto、Christopher Brown との共著です。 CRISPR によるゲノム編集から産業用バイオ触媒まで、酵素はヘルスケア、エネルギー、製造業にお
はじめに データマネジメントPF統括部の平尾です。 Databricksのエバンジェリスト認定資格であるDatabricks Championとしても活動しています。 今回はDatabricks Data + AI Summit 2026(DAIS2026)で発表されたUnity AI Gatewayのアップデートについて、主要ポイントに絞ってご紹介します。 Unity AI Gatewayとは Unity AI GatewayはDatabricksの中央AIガバナンスレイヤーであり、エージェント、ツール
はじめに NTTデータ データマネジメントPF統括部の青木です。先日、サンフランシスコで開催されたDatabricksの年次カンファレンス「Data + AI Summit 2026」に現地参加しました。 今回のカンファレンスで注目を集めた機能の一つが 「OpenSharing」 です。発表自体はカンファレンス直前に行われましたが、Keynoteでも取り上げられ、Databricksが目指すAI時代のデータ・AI基盤を支える重要な機能として紹介されていました。 https://www.databricks
はじめに NTTデータDatabricksビジネス推進室の中川です。先日サンフランシスコで開催されたDatabricksの年次カンファレンス「Data + AI Summit 2026」において、データ・AIプラットフォームの運用負荷を低減する新機能『Genie ZeroOps』が発表されました。 https://www.databricks.com/blog/introducing-genie-zeroops 本記事では、Bilal Aslam氏によるData + AI SummitのKeynoteを振
1.はじめに 金融イノベーション本部の神田です。 先日サンフランシスコで開催されたDatabricksの年次カンファレンス「Data + AI Summit 2026」に参加しました。オープンテーブルフォーマット(以下OTFと記載)のApache Iceberg(以下、Iceberg)およびDelta Lake(以下、Delta)のバージョンアップに関するセッションに参加しましたので、そのレポートをさせていただきます。 <参加したセッション> https://www.databricks.com/data