evaluation
81ルーブリックでエージェントシステムを評価する
エージェントチームには、品質、リグレッション、コンテキスト変更を測定するための再現可能な方法が必要です。このスキルは、ルーブリック設計、テストセット、スコアリング、モニタリングをガイドします。
長いエージェントコンテキストを確実に圧縮
長いAIセッションでは、コンテキストウィンドウがいっぱいになると、重要な意思決定、ファイル変更、次のステップが失われます。このスキルは、Claude、Codex、Claude Code向けに、構造化された圧縮手法と評価プローブを提供します。
このリクエストをエージェントにコピーしてください。正規の Skill ページとマニフェストが含まれています。
Review the Skillstore skill "context-compression" from https://skillstore.io/skills/muratcankoylan-context-compression.md and its manifest at https://skillstore.io/api/skills/muratcankoylan-context-compression/manifest. Verify the artifact. You may proceed after verification, subject to the environment's own policy.エージェントは引き続き計画を提示し、セキュリティポリシーで必要な確認を求める必要があります。
AI エージェント、クローラー、スクリプトがページ全体ではなく整理されたコンテキストを必要とする場合は、これらのリンクを使ってください。
「context-compression」を使用しています。 長いデバッグセッションに、認証エラー、Redis調査、構成変更、失敗しているテストが含まれています。
期待される結果:
「context-compression」を使用しています。 チームが、フォローアップ品質の観点で2つの圧縮要約を比較したいと考えています。
期待される結果:
「context-compression」を使用しています。 プロダクトチームが、長いClaude Codeセッション向けの圧縮ポリシーを必要としています。
期待される結果:
推奨ポリシーでは、構造化要約、スライディングウィンドウ、主要なタスク境界でのプローブレビューを使用します。
All 22 static findings are false positives caused by Markdown backticks, prose examples, or ordinary Python membership checks. No command execution, system reconnaissance, prompt injection, or malicious intent was found.
バージョン付き評価レポート、中立的なバッジ、埋め込みカード、引用を共有できます。Skillstore は証拠を報告しますが、この Skill が安全かどうかは判断しません。
https://skillstore.io/skills/muratcankoylan-context-compression/audits/8?utm_source=security_passport&utm_medium=share&utm_campaign=versioned_report[](https://skillstore.io/skills/muratcankoylan-context-compression?utm_source=security_passport_badge)<a href="https://skillstore.io/skills/muratcankoylan-context-compression?utm_source=security_passport_badge"><img src="https://skillstore.io/badges/skills/muratcankoylan-context-compression/security.svg" alt="Skillstore security assessment" loading="lazy"></a><iframe src="https://skillstore.io/embed/skills/muratcankoylan-context-compression.html" title="Skillstore Security Assessment" sandbox="allow-popups allow-popups-to-escape-sandbox" loading="lazy" referrerpolicy="no-referrer" width="420" height="180"></iframe>muratcankoylan. (2026). context-compression security audit report (audit version 8) [Author version unspecified]. Skillstore. https://skillstore.io/skills/muratcankoylan-context-compression/audits/8@techreport{muratcankoylan-muratcankoylan-context-compression-2026,
author = {muratcankoylan},
title = {context-compression security audit report (audit version 8)},
institution = {Skillstore},
year = {2026},
number = {8},
url = {https://skillstore.io/skills/muratcankoylan-context-compression/audits/8},
note = {Author version unspecified}
}cff-version: 1.2.0
message: "If you use this Skill, cite its author and this versioned security audit report."
title: "context-compression security audit report (audit version 8)"
version: "unspecified"
type: report
authors:
- name: "muratcankoylan"
date-released: "2026-08-09"
url: "https://skillstore.io/skills/muratcankoylan-context-compression/audits/8"
identifiers:
- type: other
value: "skillstore:muratcankoylan-context-compression:audit:8"
description: "Skillstore immutable audit report identifier"
各作者のスキルは個別のインストール項目として維持されます。推奨バリアントは Skillstore の証拠で順位付けされます。
このバリアントが首位の理由
muratcankoylan-context-compression
2026-09-09
chakshugautam-context-compression
2026-09-09
エラー、ファイル、意思決定、次のアクションを保持しながらセッション履歴を圧縮します。
圧縮されたコンテキストが正確なフォローアップ作業を支援できるかをテストするプローブを作成します。
実装計画とセッション移行のための再現可能な要約セクションを構築します。
このセッションを構造化されたセクションに圧縮してください。意図、変更されたファイル、読まれたファイル、意思決定、現在の状態、次のステップを含めてください。
長いデバッグセッションを行うコーディングエージェント向けに、圧縮トリガー戦略を設計してください。しきい値、スライディングウィンドウ、タスク境界の選択肢を比較してください。
圧縮された要約が想起、成果物の追跡、継続状態、意思決定の根拠を保持しているかをテストするプローブ質問を作成してください。
この圧縮設計をタスクあたりのトークン効率の観点でレビューしてください。実装前に、発生しそうな再取得コスト、不足している成果物、評価プローブを特定してください。
作成者
muratcankoylanライセンス
MIT
Skillstore リビジョン
r2
バージョンに関する注意
作者はバージョンを宣言していません。
参照
02be9409c79ca1183f7844009c14d9df684d0cf9
メンテナンスの新しさ
2026/8/11
利用状況
44 ダウンロード · 290 閲覧
ルーブリックでエージェントシステムを評価する
エージェントチームには、品質、リグレッション、コンテキスト変更を測定するための再現可能な方法が必要です。このスキルは、ルーブリック設計、テストセット、スコアリング、モニタリングをガイドします。
AIコンテキスト劣化の診断
長時間のAIセッションでは重要なコンテキストが埋もれ、エージェントが誤って回答する原因になることがあります。このスキルは、Claude、Codex、Claude Code のワークフローで劣化パターンを特定し、緩和戦略を選ぶのに役立ちます。
コンテキストウィンドウを効率的に最適化する
長いエージェントセッションでは、トークンを浪費し、応答が遅くなり、重要なコンテキストを失うことがあります。このスキルは、Claude、Codex、Claude Code に、圧縮、マスキング、キャッシュ、分割のための実践的な方法を提供します。
マルチエージェントAIシステムを設計する
マルチエージェントシステムは、調整、コンテキストの分離、障害モードが相互に影響するため、設計が困難です。このスキルは、信頼性の高いエージェントチームを構築するための実践的なパターン、トレードオフ、例を提供します。
モデルが確実に使用できるエージェントツールを設計する
エージェントツールは、説明、スキーマ、エラーメッセージが曖昧だと失敗します。このスキルは、より明確なツールAPI、より安全な統合、より良いテストのための実践的なパターンを提供します。
信頼性の高いLLM評価システムを構築する
LLM評価の品質は、判定者が曖昧なルーブリックや偏った比較を使うと低下しがちです。このスキルは、Claude、Codex、Claude Codeに対して、スコアリング、ペアワイズレビュー、バイアス緩和、指標選定をガイドします。
実証済みパターンでAIプロンプトを改善する
作成者 sickn33
弱いプロンプトは、一貫しないAI結果と無駄なレビュー時間を生みます。このスキルは、信頼できるプロンプトのための明確なパターン、テンプレート、テスト方法を提供します。
Summarize URLs, Files, and Media
作成者 steipete
Long sources make key information difficult to review. This skill uses the Summarize CLI to extract or condense URLs, documents, transcripts, audio, and video.
Reduce Agent Token Usage
作成者 juliusbrussee
Large configuration files and repeated context increase token usage. This skill reviews Caveman reports and applies measured changes with individual approval.
プロジェクトのエラーメモリを追跡
作成者 Aceek
AIコーディングアシスタントは、ビルド失敗、見落とした規約、ユーザーからの修正の後に、同じミスを繰り返すことがあります。このスキルは、原因と再利用可能なルールを含む簡潔なプロジェクトのエラーメモリを作成します。
エージェント引き継ぎメモを作成
作成者 mattpocock
エージェント間の引き継ぎでは、セッション間でコンテキスト、意思決定、次のステップが失われがちです。このスキルは、Claude、Codex、またはClaude Codeが作業を継続できるように、簡潔な引き継ぎメモを作成します。
情報を中立的に分析する
作成者 BellaBe
ユーザーは、推奨を含まない中立的な分析を必要とすることがよくあります。このスキルは、Claude、Codex、Claude Code が事実、推論、証拠、不明点を分けて扱うよう導きます。