タグ: テスト
「テスト」に関連する記事を表示しています。
マイクロサービスのFlakyテスト、CIで再現できない原因を切り分ける手順
CIで再現しないFlakyテストの原因を、競合状態・外部依存・テスト肥大化などに分解し、確認コマンドと修正パターンを整理しました。
AIエージェントのUI自動テストが遅い理由と改善設計3選
AIエージェントのUI操作テストが遅い原因を、知覚と推論の分離設計から解説。判断軸と実測値をもとに導入可否を整理しました。
Claude API の会話コンパクト機能とは。CI連携テストへの影響を確認する
Claude APIの会話コンパクト機能を、CI/CDでのテスト戦略とコンテキスト管理の観点から整理し、確認すべき設定を解説します。
AIエージェントの評価は42個のツールで検証すべき理由(Silo v0.4.0)
AIエージェントの評価をテキスト応答だけで判定すると、実際の副作用の欠落を見逃します。状態検証ツールSiloの仕組みと導入判断を整理しました。
OpenAI Habitatに学ぶ、大規模ストレージ基盤の負荷試験と段階的リリース設計
OpenAIのストレージ基盤Habitatの進化から、分散化に伴うテスト戦略・リリース手法の見直しポイントを整理しました。
ChatGPT Work「Data agent」登場、QAが検証すべき自動生成の正確性
ChatGPT Workの新機能Data agentを、QA視点で見た際の検証ポイントを整理。生成AIによる集計の品質保証設計と確認手順を解説します。
CIのグリーンチェックは信用できるか フレーキーテスト対策とクラウド監視の共通点
CIのグリーンチェックを条件反射でマージ許可にしていませんか。フレーキーテスト対策とクラウド障害対応の共通点から、機械的なゲート設計を整理しました。
AIエージェントを業務プロセスに組み込む前にQAが見るべき3点
AIエージェントを業務フローに組み込む企業が増える中、CI/CDパイプラインとテスト戦略に何を見直す必要があるかを整理しました。
AIコーディングエージェントの「偽の完了」を防ぐ受け入れテスト設計
AIコーディングエージェントが「完了」と報告しても要件の中核が抜けている「偽の完了」の原因と、受け入れテスト固定による対策を解説します。
Anthropic系AI導入時のシステムプロンプト公開有無を判断基準にする方法
AnthropicがClaudeのシステムプロンプトを公開・履歴管理している事例から、AI導入時にベンダーの透明性をどう見積もりやQAに組み込むか判断軸を整理しました。
Codex×GPTで自治体AI開発、QAはどう変わるか 生成AI導入の品質観点
自治体向けAI基盤にCodexを使う事例を題材に、AI生成コードのテスト戦略・eval設計・CI/CDでの品質担保のポイントを整理しました。
LangChain 1.4.0a2のMCPアダプタをCIでテストする手順
LangChain 1.4.0a2のMCPアダプタをインストールから動作確認、CIでの安定運用まで手順化。フレーキーテスト対策も解説します。