The catalog
325,949 rows, by stacks then stars
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/dbscan-parameter-tuning/run1_greedy-point-matching Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run1 mars cloud data loading matching
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/dbscan-parameter-tuning/run1_mars-cloud-data-loading-matching Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run1 output formatting pareto results
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/dbscan-parameter-tuning/run1_output-formatting-pareto-results Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run1 pareto frontier optimization
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/dbscan-parameter-tuning/run1_pareto-frontier-optimization Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Deduplicate and Order Vulnerability Records
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/dependency-vulnerability-check/run3_Deduplicate-and-Order-Vulnerability-Records Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Extract CVSS Score with Correct Priority
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/dependency-vulnerability-check/run3_Extract-CVSS-Score-with-Correct-Priority Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Filter Vulnerabilities by Severity Level
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/dependency-vulnerability-check/run3_Filter-Vulnerabilities-by-Severity-Level Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Format and Write CSV with Proper Escaping
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/dependency-vulnerability-check/run3_Format-and-Write-CSV-with-Proper-Escaping Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Handle NULL and Missing Values in Vulnerability Data
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/dependency-vulnerability-check/run3_Handle-NULL-and-Missing-Values-in-Vulnerability-Data Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Map Trivy JSON Fields to CSV Columns Accurately
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/dependency-vulnerability-check/run3_Map-Trivy-JSON-Fields-to-CSV-Columns-Accurately Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run2 Calculate Distance to Nearest Pacific Boundary
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/earthquake-plate-calculation/run2_Calculate-Distance-to-Nearest-Pacific-Boundary Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run2 Execute Complete Geospatial Analysis Pipeline
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/earthquake-plate-calculation/run2_Execute-Complete-Geospatial-Analysis-Pipeline Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run2 Filter Earthquakes Within Pacific Plate
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/earthquake-plate-calculation/run2_Filter-Earthquakes-Within-Pacific-Plate Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run2 Filter Pacific Plate Boundaries
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/earthquake-plate-calculation/run2_Filter-Pacific-Plate-Boundaries Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run2 Find Earthquake Furthest from Pacific Boundary
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/earthquake-plate-calculation/run2_Find-Earthquake-Furthest-from-Pacific-Boundary Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run2 Identify Pacific Plate Identifier
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/earthquake-plate-calculation/run2_Identify-Pacific-Plate-Identifier Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run2 Load and Parse Plate Boundary Data
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/earthquake-plate-calculation/run2_Load-and-Parse-Plate-Boundary-Data Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run2 Load and Parse Plate Polygon Data
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/earthquake-plate-calculation/run2_Load-and-Parse-Plate-Polygon-Data Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run2 Load and Validate Earthquake Data
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/earthquake-plate-calculation/run2_Load-and-Validate-Earthquake-Data Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run2 Output Result to JSON File
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/earthquake-plate-calculation/run2_Output-Result-to-JSON-File Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run2 Project Data to EPSG 4087 for Distance Calculation
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/earthquake-plate-calculation/run2_Project-Data-to-EPSG-4087-for-Distance-Calculation Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 evidence validation checkpoint
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/enterprise-information-search/run3_evidence-validation-checkpoint Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 multi hop evidence extraction
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/enterprise-information-search/run3_multi-hop-evidence-extraction Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 product grounded artifact retrieval
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/enterprise-information-search/run3_product-grounded-artifact-retrieval Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/enterprise-information-search/run3_question-parsing Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 token counting and output
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/enterprise-information-search/run3_token-counting-and-output Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Aggregate Holdings Across Multiple Funds
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/financial-analysis/run3_Aggregate-Holdings-Across-Multiple-Funds Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Calculate AUM from Holdings
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/financial-analysis/run3_Calculate-AUM-from-Holdings Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Compare Holdings Between Quarters
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/financial-analysis/run3_Compare-Holdings-Between-Quarters Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Examine Raw Holdings Data Structure
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/financial-analysis/run3_Examine-Raw-Holdings-Data-Structure Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Filter Holdings by Security Type Stocks Only
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/financial-analysis/run3_Filter-Holdings-by-Security-Type-Stocks-Only Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Fuzzy Search COVERPAGE for Fund Identification
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/financial-analysis/run3_Fuzzy-Search-COVERPAGE-for-Fund-Identification Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Load Holdings Data by Accession Number
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/financial-analysis/run3_Load-Holdings-Data-by-Accession-Number Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Search CUSIP for Security
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/financial-analysis/run3_Search-CUSIP-for-Security Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Validate Accession Number and Report Date
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/financial-analysis/run3_Validate-Accession-Number-and-Report-Date Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Create and Apply Git Patch Files for Druid Security Fixes
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/fix-security-bug/run3_Create-and-Apply-Git-Patch-Files-for-Druid-Security-Fixes Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Disable JavaScript Execution in Druid Filters
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/fix-security-bug/run3_Disable-JavaScript-Execution-in-Druid-Filters Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Input Stream Validation Before Jackson Deserialization
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/fix-security-bug/run3_Input-Stream-Validation-Before-Jackson-Deserialization Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Locate Jackson Deserialization Entry Points in Druid
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/fix-security-bug/run3_Locate-Jackson-Deserialization-Entry-Points-in-Druid Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Calculate Average PR Merge Time
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/github-repo-analytics/run3_Calculate-Average-PR-Merge-Time Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Generate Community Pulse Report JSON
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/github-repo-analytics/run3_Generate-Community-Pulse-Report-JSON Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Identify Top PR Contributor in December
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/github-repo-analytics/run3_Identify-Top-PR-Contributor-in-December Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Query GitHub Issues for December Activity
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/github-repo-analytics/run3_Query-GitHub-Issues-for-December-Activity Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Query GitHub PRs for December Activity
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/github-repo-analytics/run3_Query-GitHub-PRs-for-December-Activity Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Check Repository Dependencies
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/nlp-paper-reproduction/run3_Check-Repository-Dependencies Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Implement SimPO Loss Function
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/nlp-paper-reproduction/run3_Implement-SimPO-Loss-Function Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Install Project Dependencies in Python 3 10
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/nlp-paper-reproduction/run3_Install-Project-Dependencies-in-Python-3-10 Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Run Unit Test in Python 3 10 Environment
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/nlp-paper-reproduction/run3_Run-Unit-Test-in-Python-3-10-Environment Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Set Up Python 3 10 Environment
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/nlp-paper-reproduction/run3_Set-Up-Python-3-10-Environment Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Build Replacement Dictionary for Word Template Placeholders
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/offer-letter-generator/run3_Build-Replacement-Dictionary-for-Word-Template-Placeholders Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Extract and Replace Text in Word Document Runs
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/offer-letter-generator/run3_Extract-and-Replace-Text-in-Word-Document-Runs Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Load and Validate Data from JSON for Document Templating
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/offer-letter-generator/run3_Load-and-Validate-Data-from-JSON-for-Document-Templating Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Process Conditional Sections in Word Documents
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/offer-letter-generator/run3_Process-Conditional-Sections-in-Word-Documents Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Save Modified Word Document to Disk
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/offer-letter-generator/run3_Save-Modified-Word-Document-to-Disk Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Traverse All Locations in Word Documents
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/offer-letter-generator/run3_Traverse-All-Locations-in-Word-Documents Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Classify Documents by Subject Content
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/organize-messy-files/run3_Classify-Documents-by-Subject-Content Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Extract DOCX Content and Structure
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/organize-messy-files/run3_Extract-DOCX-Content-and-Structure Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Extract PDF Content and Metadata
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/organize-messy-files/run3_Extract-PDF-Content-and-Metadata Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Extract PPTX Content and Structure
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/organize-messy-files/run3_Extract-PPTX-Content-and-Structure Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.
Run3 Scan Source Directory and Plan Organization
cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/organize-messy-files/run3_Scan-Source-Directory-and-Plan-Organization Skill
75★ repo[COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.