「テスト」に関連する技術ブログ - TECH PLAY

TECH PLAY

テスト」に関連する技術ブログ

7373 件中 271 - 285 件目
本記事は Kiro ブログの記事「 Introducing Kiro Crew 」(2026年8月4日、著者: Bolin Chen、Zejiang (Joe) Guo、Zezhen Xu)を翻訳したものです。 気持ちのいい金曜日の午後。そろそろ仕事を切り上げて、外の天気を楽しもうとしています。ちょうど片付けを始めたところで、チームメイトから緊急のレイテンシー急増について助けてほしいと連絡が入ります。あなたは似たようなインシデントを覚えています。どのメトリクスを調べればいいか、どの診断を走らせるか、前回ロ
本記事は 2026 年 8 月 3 日に公開された Clare Liguori、Romain Dura、Al Harris、Richard Threlkeld による “ One agent, every surface: how we built the Kiro agent harness ” を翻訳したものです。 Kiro の開発初期、私たちは開発者の 1 日のなかでエージェント駆動の開発がどのように感じられるべきかを議論し始めました。繰り返し立ち返ったのは、セッションがラップトップとクラウドサンド
はじめに こんにちは!サイオステクノロジーのなーがです。 前回、 Claude Code のサブエージェントが勝手に多段委譲してトークンを溶かす問題を、hooks で機械的に止めた話 を書きました。「プロンプトでのお願いは守られないことがあるので、破られると困るルールは hook に落とす」という教訓ですね。 その味をしめて、同じ個人開発の Python プロジェクトで、今度は テスト に同じ手を使いました。Stop hook で「編集した領域のテストが通るまでセッションを終わらせない」ゲートを作ったんで
こんにちは。エンタープライズ第二本部 プラットフォームエンジニアリング部 2年目の菊池祥汰です。業務では AI サポートセンターとして生成 AI / LLM 活用案件や dJ グループ内の生成 AI 利活用推進などを行っています。 この記事では、従量課金・投資回収フェーズに入っている筈の LLM ベンダーが、昨今ベンチマークスコア比のトークン単価を下げ続けているという事実に対して、検証ベースの定量的な評価を述べます。より具体的に言うのであれば、 「Claude Mythos/Fable 級と評されるモデル
はじめに Chrome拡張機能は便利な反面、利用する拡張機能によってはセキュリティや運用面を考慮する必要があります。 今回、社内で利用するHTTPヘッダー付与ツールが必要になったため、この機会にAIと対話しながらChrome拡張機能を自作してみることにしました。 本記事では、「AIを活用してどのように改善を重ね、実運用できるツールへ育てていったか」を紹介します。 作ろうと思ったきっかけ HTTPヘッダーを付与するChrome拡張機能は数多く公開されています。 しかし、社内で継続的に利用するツールとして考え
はじめに こんにちは。RevComm でエンジニアをしている 林 です。 AI コーディングエージェントの普及でコードを書くコストは大きく下がり、ボトルネックはレビューと定型的な保守作業に移りました。 Addy Osmani 氏も「 Agentic Code Review 」で、レビューが PR の作成スピードに追いつかず、コードが読まれないままマージされ始めている現状を書いています。 MiiTel Phone(ブラウザ上で通話できる AI 搭載 IP 電話アプリ)の開発リポジトリでは月に 300〜600
AWS メディア業界向け勉強会 #9(2026 年 7 月 10 日開催) 2026 年 7 月 10 日(金)に、メディア業界のお客様向けに AWS 勉強会を開催いたしました。放送局のお客様にご登壇いただき、 AWS の活用事例についてご紹介いただきました。この記事では、カスタムモデルの生成等を通じてリアルタイム翻訳の精度を向上させた事例や、社内の基幹システムをクラウド移行する際の勘所、AI 会話システムの構築、クラウド編集環境の構築、社内ハッカソンにおける Kiro の活用などのメディア業界におけるク
はじめに こんにちは、ZOZOMO部OMOブロックの宮澤・多田・東谷です。私たちは2026年7月22日(水)・23日(木)の2日間、JPタワーホール&カンファレンスにて開催された「AI DevEx Conference 2026」に参加してきました。本記事では、会場や各ブースの様子に加え、特に印象に残ったセッションをご紹介します。 目次 はじめに 目次 AI DevEx Conference 2026とは 会場の様子 セッション紹介 Day1(7/22) AIと共存する世界のソフトウェアエンジニアリング─
G-gen の佐々木です。当記事では、Agent Runtime にデプロイしたエージェントの呼び出し元を IAM 拒否ポリシーで特定のプリンシパルのみに制限する方法を、Gemini Enterprise アプリからの接続を例に紹介します。 前提知識 Agent Runtime とは Gemini Enterprise とは IAM ポリシーの仕組み 当記事のシナリオ アクセス制限の考え方 エージェントの呼び出しに必要な権限 Gemini Enterprise の呼び出し元 ID 制限に使用する2つの I
トリビューでCTOをしている小尾(@obiyuta)です。 弊社では2026年7月、美容医療アプリ「トリビュー」にAI相談機能をリリースしました。前回のフロントエンド編では、LLMの仕事を、どの画面部品に何を表示するかを指定するJSON(テンプレートJSON)の出力までに絞り、画面の組み立てと実データの取得はフロントエンドが担う設計をご紹介しました。 今回はバックエンド編です。バックエンドも考え方は同じで、LLMにすべてを任せるのではなく、任せる範囲や役割を明確に設計しています。LLM・API・RAGの役
G-gen の高宮です。当記事は、Google Cloud Next Tokyo 26 の2日目に行われたカスタマーセッション「 非エンジニアが安心してバイブ コーディングして公開するには?セキュアな AI 駆動開発ハーネスの仕組み 」のレポートです。 他の Google Cloud Next Tokyo 26 の関連記事は Google Cloud Next Tokyo 26 カテゴリ の記事一覧からご覧いただけます。 セッションの概要 生の AI 駆動開発の問題点 AI 駆動開発ハーネス「Exoloo
1. はじめに 生成AIアプリケーションを評価する際、回答が正しいかどうかだけを確認していないでしょうか。 実際に生成AIやAIエージェントを運用する場合は、回答品質に加えて、次のような観点も必要です。 応答にどれくらい時間がかかるか トークンやコストがどれくらい発生するか ツールを正しく選択できているか ツール実行に失敗した場合、最終回答がその結果と整合しているか 評価に利用するLLM Judge自体を信頼できるか 今回は、AWS Samplesで公開されているsample-gen-ai-evaluat
G-gen の今村です。当記事は、Google Cloud Next Tokyo 26 の2日目に行われた Google セッション「 Gemini Enterprise Agent Platform 入門!進化した次世代エージェント構築基盤の全貌 」のレポートです。 他の Google Cloud Next Tokyo 26 の関連記事は Google Cloud Next Tokyo 26 カテゴリ の記事一覧からご覧いただけます。 セッションの概要 Gemini Enterprise Agent P
概要 メルカリでは、CoreDB と呼ばれる中核データベースを長年オンプレミス上の MySQL で運用してきました。本記事では、2026 年 4 月に完了した MySQL から TiDB への移行を振り返り、長期的なスケーラビリティの改善、弾力的なリソース確保、クラウド化による運用負荷の軽減といった成果を紹介します。また、移行フローや ProxySQL を活用した段階的な切り替えでうまくいった点、実トラフィックを用いた検証やコスト見積もりで直面した課題、移行後に見えてきた改善テーマについても整理します。
今月誕生日の人、おめでとうございます🎉 エデュケーショナルサービス課の森純子です。 2026年7月30日、AWS Identity and Access Management(IAM)の Policy Simulator に大幅なアップデートが入りました🎉 IAM Policy Simulator moves to the IAM console and adds additional capabilities(2026年7月30日) IAM Policy Simulator は、IAM ポリシーが付与す