「GPU」に関連する技術ブログ - TECH PLAY

TECH PLAY

「GPU」に関連する技術ブログ

全 366 件中 1 - 15 件目
はじめに Turing の mlops 3 チームの加藤です。2026 年 3 月に Turing に入社し、自動運転モデルの学習基盤の開発ワークフロー改善を担当しています。最近は主に学習を高速化しています。 今回は、学習時に S3 から直接データを読み出すことで、学習データ容量の制限と、クラスタへの学習データのステージングを無くした時の話をしたいと思います。 この記事の内容 学習データを S3 から直接読む構成に変え、学習に使えるデータ量をクラスタのストレージ容量から切り離した。 S3 の帯域は十分だっ
はじめに # GFXBenchというGPUベンチマークソフトを取り上げたシリーズの4回目です。 前回で古いAndroidバージョン対応のビルドが行えました。 今回は実際に古いAndroidバージョンで実行してベンチマークスコアを確認してみます。 ベンチマーク実行結果 # 実行までの手順は今までと変わらないので、早速結果からです。 実行するAndroid端末はAndroidバージョンが古いものを手元のコレクションから見繕ってみます。 目標は SdkVersion:'21' (Android5.0) だったの
はじめに # 前回の記事( 自前vLLMをOpen WebUI経由でVS Code(Cline)に接続!トークンフリーで開発する )では、オープンソースのWeb UI・APIゲートウェイ「Open WebUI」を採用し、AWS上で動かす自前vLLMサーバーをVS Code拡張機能「Cline」のバックエンドとして直結させました。 前回の検証では「1台のGPUサーバー( g6.xlarge )をチーム3〜5人でシェアする」運用モデルを検討し、実用的なコストパフォーマンスが得られることを確認しました。しかし、
2026年7月29日から 2 日間にわたって、 アマゾンウェブサービスジャパン合同会社はパシフィコ横浜で開催された KubeCon + CloudNativeCon Japan 2026 においてスポンサーとしてブースを出展しており、たくさんの方にご来場いただきました。(ご来場いただいた皆様、有難うございました!)   AWS ブースでは、2日間で 12 のデモセッションを行い、多くのご来場者にご視聴いただきました。その際にセッション資料をシェアしてほしいとのご要望をいくつか頂いたことを受け、こ
はじめに Turingのインフラチームで、クラウドGPUクラスタの構築・運用を担当している大戸(おおど)です。先日、Platform Engineering Kaigi 2026(PEK2026)で、マルチクラウドとオンプレミスにまたがるGPU基盤の構築・運用についてお話ししました。この記事は登壇後の補足として、AWSでのストレージ運用を詳しくまとめたものです。 この記事を3行でまとめると GPUは認識されているのに、学習が進まない。Turingの学習環境で起きたFSx for LustreのI/O問題を
この記事の対象者 コーディングエージェントをローカルで構築したい方 GPU環境(筆者はRTX 3060(VRAM 12GB))をお持ちの方 Windows環境で実装したい方 ※本記事で紹介するツール・モデルの評価は執筆時点の検証結果に基づくものであり、利用にあたっては各組織のセキュリティポリシーおよび利用規約をご確認ください。 はじめに 近年Codex、Claude Codeなど多様なコーディングエージェントアプリが出ており、コーディングエージェントを誰でも試すことができる時代になりました。 一方で、投入
はじめに 2026年7月15日(水)に「さくらの夕べ in 松山 with アリスタネットワークス」を開催しました。今回のイベントは同時期に愛媛県松山市で開催されたJANOG58ミーティングに併せて実施したもので、JAN […]
G-gen の佐藤です。BigQuery の Conversational Analytics (対話型分析)において、データセットやモデルが知識として持っていない最新情報を取り入れるために Google 検索グラウンディング を組み合わせる方法を紹介します。 はじめに 当記事について 前提知識 ユースケース 実装方針 料金 共通の設定手順 開発者への IAM 権限付与 エージェントの作成 利用者への IAM 権限付与 Google アカウントによる認証の場合 利用者に追加の権限の付与 検証済みクエリの追
Amazon EC2 で AMI 上で利用できるインスタンスタイプを指定できるようになりました 「このAMI、うっかり関係ないインスタンスタイプで起動されて起動失敗した」みたいな事故、地味に起きがちです。 今回、AMI側に利用できるインスタンスタイプを定義できるアップデートが入ったので、実際に触って挙動を確認してみました。 Amazon EC2 が AMI と互換性のあるインスタンスタイプの指定をサポート 対象としている読者 独自AMIを配布・運用していて、意図しないインスタンスタイプで起動されるのを防ぎ
はじめに # オープンソースLLMが急速に進化する中、「機密情報や社内コードも気にせず扱える、自分専用のローカルLLM環境が欲しいな」と思い立ちました。 ただ、いざ本格的に手元(オンプレミス)で動かそうとすると、大容量VRAMを積んだGPU搭載PCが必要になり、 調達するのに数十万円もの初期費用(イニシャルコスト) がかかってしまいます。「まずは効果があるか試してみたい」という検証段階で、いきなり高額なハードウェア購入稟議を通すのはハードルが高いものです。 だからこそ、初期投資ゼロ・使った時間分だけ(数十
はじめに 本ブログは、株式会社第一興商と Amazon Web Services Japan が共同で執筆しました。 株式会社第一興商 (以下、第一興商)では、通信カラオケ「DAM」シリーズにおける採点機能の高度化に取り組んでおり、AWS Professional Services と共同で、人間の聴感に即した歌声評価 AI モデル「聴感採点モデル」を開発しました。この技術は、DAM のフラッグシップモデル LIVE DAM WAO! に搭載されている採点機能 精密採点Ai Heart の中核として活用さ
こんにちは、イノベーションセンターの福田です。 普段はAIエージェントの検証や開発と、チーム内資産のDevOpsに取り組んでいます。 コーディングエージェントの普及によって、LLMは日々の開発で欠かせない道具となりました。 その多くはクラウド型のサービスを通じて利用されており、高性能なモデルをすぐに使える環境が整っています。 同時に、日々の開発で常用するものだからこそ、扱うデータや利用の実態を自組織の内側に収めておきたい場面も出てきます。 そのため、クラウド型のサービスを活用しつつ、自組織で動かす選択肢も
みなさん、こんにちは。AWS ソリューションアーキテクトの木村です。 9 月も半ばに差し掛かり、朝晩は少しずつ秋の気配を感じられるようになってきました。 re:Invent 2026 のセッションカタログ も公開され、年末に向けた楽しみが増えてきましたね。 お昼休みの 30 分で最新情報を知れる「 もぐもぐAWS 」では、AI をテーマにした会が 9 月 / 10 月に予定されていますので是非ご参加ください。 「 AWS ジャパン生成 AI 実用化推進プログラム 」も引き続き募集中ですのでよろしくお願いし
― Harness EngineeringとSwitchyardで考えるTokenomics はじめに 1つ前の記事では、NVIDIA研修の事前課題についてご紹介しました。この記事では、NVIDIA の AI Advisors Workshop に参加してきましたので、その続きについてお伝えします。(講師は、マクニカ、NVIDIA の方でした) 研修では、Agentic AI、NVIDIAのAIエコシステム、AI Factory、製造業・金融業でのユースケース、Go-To-Market、PoCの進め方など
はじめに 生成 AI は、いまやあらゆる産業に新たな価値創出の機会をもたらす基盤技術になりつつあります。文章の作成や要約、コードの生成、問い合わせ対応、専門的な調査の補助など、これまで人手に頼っていた多くの業務を支援できるようになり、生産性向上とイノベーション創出のカギとして大きな期待が寄せられています。 その一方で、機密情報や個人情報を外部の生成 AI サービスに入力することへの懸念から、本格的な活用に踏み切れない企業も少なくありません。総務省の調査によれば、約 7 割の企業が AI 活用における「セキ