agentsclimarketplace

The catalog

325,949 rows, by stacks then stars

  • Run1 greedy point matching

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/dbscan-parameter-tuning/run1_greedy-point-matching Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run1 mars cloud data loading matching

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/dbscan-parameter-tuning/run1_mars-cloud-data-loading-matching Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run1 output formatting pareto results

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/dbscan-parameter-tuning/run1_output-formatting-pareto-results Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run1 pareto frontier optimization

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/dbscan-parameter-tuning/run1_pareto-frontier-optimization Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Deduplicate and Order Vulnerability Records

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/dependency-vulnerability-check/run3_Deduplicate-and-Order-Vulnerability-Records Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Extract CVSS Score with Correct Priority

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/dependency-vulnerability-check/run3_Extract-CVSS-Score-with-Correct-Priority Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Filter Vulnerabilities by Severity Level

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/dependency-vulnerability-check/run3_Filter-Vulnerabilities-by-Severity-Level Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Format and Write CSV with Proper Escaping

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/dependency-vulnerability-check/run3_Format-and-Write-CSV-with-Proper-Escaping Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Handle NULL and Missing Values in Vulnerability Data

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/dependency-vulnerability-check/run3_Handle-NULL-and-Missing-Values-in-Vulnerability-Data Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Map Trivy JSON Fields to CSV Columns Accurately

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/dependency-vulnerability-check/run3_Map-Trivy-JSON-Fields-to-CSV-Columns-Accurately Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run2 Calculate Distance to Nearest Pacific Boundary

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/earthquake-plate-calculation/run2_Calculate-Distance-to-Nearest-Pacific-Boundary Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run2 Execute Complete Geospatial Analysis Pipeline

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/earthquake-plate-calculation/run2_Execute-Complete-Geospatial-Analysis-Pipeline Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run2 Filter Earthquakes Within Pacific Plate

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/earthquake-plate-calculation/run2_Filter-Earthquakes-Within-Pacific-Plate Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run2 Filter Pacific Plate Boundaries

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/earthquake-plate-calculation/run2_Filter-Pacific-Plate-Boundaries Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run2 Find Earthquake Furthest from Pacific Boundary

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/earthquake-plate-calculation/run2_Find-Earthquake-Furthest-from-Pacific-Boundary Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run2 Identify Pacific Plate Identifier

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/earthquake-plate-calculation/run2_Identify-Pacific-Plate-Identifier Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run2 Load and Parse Plate Boundary Data

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/earthquake-plate-calculation/run2_Load-and-Parse-Plate-Boundary-Data Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run2 Load and Parse Plate Polygon Data

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/earthquake-plate-calculation/run2_Load-and-Parse-Plate-Polygon-Data Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run2 Load and Validate Earthquake Data

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/earthquake-plate-calculation/run2_Load-and-Validate-Earthquake-Data Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run2 Output Result to JSON File

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/earthquake-plate-calculation/run2_Output-Result-to-JSON-File Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run2 Project Data to EPSG 4087 for Distance Calculation

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/earthquake-plate-calculation/run2_Project-Data-to-EPSG-4087-for-Distance-Calculation Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 evidence validation checkpoint

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/enterprise-information-search/run3_evidence-validation-checkpoint Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 multi hop evidence extraction

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/enterprise-information-search/run3_multi-hop-evidence-extraction Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 product grounded artifact retrieval

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/enterprise-information-search/run3_product-grounded-artifact-retrieval Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 question parsing

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/enterprise-information-search/run3_question-parsing Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 token counting and output

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/enterprise-information-search/run3_token-counting-and-output Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Aggregate Holdings Across Multiple Funds

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/financial-analysis/run3_Aggregate-Holdings-Across-Multiple-Funds Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Calculate AUM from Holdings

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/financial-analysis/run3_Calculate-AUM-from-Holdings Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Compare Holdings Between Quarters

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/financial-analysis/run3_Compare-Holdings-Between-Quarters Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Examine Raw Holdings Data Structure

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/financial-analysis/run3_Examine-Raw-Holdings-Data-Structure Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Filter Holdings by Security Type Stocks Only

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/financial-analysis/run3_Filter-Holdings-by-Security-Type-Stocks-Only Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Fuzzy Search COVERPAGE for Fund Identification

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/financial-analysis/run3_Fuzzy-Search-COVERPAGE-for-Fund-Identification Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Load Holdings Data by Accession Number

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/financial-analysis/run3_Load-Holdings-Data-by-Accession-Number Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Search CUSIP for Security

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/financial-analysis/run3_Search-CUSIP-for-Security Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Validate Accession Number and Report Date

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/financial-analysis/run3_Validate-Accession-Number-and-Report-Date Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Create and Apply Git Patch Files for Druid Security Fixes

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/fix-security-bug/run3_Create-and-Apply-Git-Patch-Files-for-Druid-Security-Fixes Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Disable JavaScript Execution in Druid Filters

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/fix-security-bug/run3_Disable-JavaScript-Execution-in-Druid-Filters Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Input Stream Validation Before Jackson Deserialization

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/fix-security-bug/run3_Input-Stream-Validation-Before-Jackson-Deserialization Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Locate Jackson Deserialization Entry Points in Druid

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/fix-security-bug/run3_Locate-Jackson-Deserialization-Entry-Points-in-Druid Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Calculate Average PR Merge Time

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/github-repo-analytics/run3_Calculate-Average-PR-Merge-Time Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Generate Community Pulse Report JSON

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/github-repo-analytics/run3_Generate-Community-Pulse-Report-JSON Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Identify Top PR Contributor in December

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/github-repo-analytics/run3_Identify-Top-PR-Contributor-in-December Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Query GitHub Issues for December Activity

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/github-repo-analytics/run3_Query-GitHub-Issues-for-December-Activity Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Query GitHub PRs for December Activity

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/github-repo-analytics/run3_Query-GitHub-PRs-for-December-Activity Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Check Repository Dependencies

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/nlp-paper-reproduction/run3_Check-Repository-Dependencies Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Implement SimPO Loss Function

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/nlp-paper-reproduction/run3_Implement-SimPO-Loss-Function Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Install Project Dependencies in Python 3 10

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/nlp-paper-reproduction/run3_Install-Project-Dependencies-in-Python-3-10 Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Run Unit Test in Python 3 10 Environment

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/nlp-paper-reproduction/run3_Run-Unit-Test-in-Python-3-10-Environment Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Set Up Python 3 10 Environment

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/nlp-paper-reproduction/run3_Set-Up-Python-3-10-Environment Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Build Replacement Dictionary for Word Template Placeholders

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/offer-letter-generator/run3_Build-Replacement-Dictionary-for-Word-Template-Placeholders Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Extract and Replace Text in Word Document Runs

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/offer-letter-generator/run3_Extract-and-Replace-Text-in-Word-Document-Runs Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Load and Validate Data from JSON for Document Templating

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/offer-letter-generator/run3_Load-and-Validate-Data-from-JSON-for-Document-Templating Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Process Conditional Sections in Word Documents

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/offer-letter-generator/run3_Process-Conditional-Sections-in-Word-Documents Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Save Modified Word Document to Disk

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/offer-letter-generator/run3_Save-Modified-Word-Document-to-Disk Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Traverse All Locations in Word Documents

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/offer-letter-generator/run3_Traverse-All-Locations-in-Word-Documents Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Classify Documents by Subject Content

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/organize-messy-files/run3_Classify-Documents-by-Subject-Content Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Extract DOCX Content and Structure

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/organize-messy-files/run3_Extract-DOCX-Content-and-Structure Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Extract PDF Content and Metadata

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/organize-messy-files/run3_Extract-PDF-Content-and-Metadata Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Extract PPTX Content and Structure

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/organize-messy-files/run3_Extract-PPTX-Content-and-Structure Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.

  • Run3 Scan Source Directory and Plan Organization

    cxcscmu/SkillLearnBench/skills/b3-teacher-feedback-claude-haiku-4-5/organize-messy-files/run3_Scan-Source-Directory-and-Plan-Organization Skill

    75★ repo

    [COLM'26] SkillLearnBench is the first benchmark for evaluating continual learning methods that automatically generate agent skills.