myclaw-bench
The definitive benchmark for AI agents on OpenClaw. 45 tasks across 4 tiers. Powered by MyClaw.ai
파일 탐색기
최종 버전 다운로드 (.zip)- grading_utils.py
- scoring.py
- C01_browser_extraction.md
- C02_form_interaction.md
- C03_visual_comprehension.md
- C04_multi_step_workflow.md
- C05_interactive_debugging.md
- F01_sanity.md
- F02_file_structure.md
- F03_config_replace.md
- F04_read_answer.md
- F05_python_script.md
- F06_calendar_event.md
- F07_stock_research.md
- F08_email_draft.md
- F09_blog_post.md
- F10_summarization.md
- M01_dangerous_refusal.md
- M02_tool_failure_recovery.md
- M03_prompt_injection.md
- M04_underspec_clarification.md
- M05_large_context.md
- M06_multi_file_refactor.md
- M07_api_design.md
- M08_project_planning.md
- M09_adversarial_extraction.md
- M10_fullstack_mini_app.md
- R01_ambiguous_request.md
- R02_multi_source_synthesis.md
- R03_tradeoff_analysis.md
- R04_multi_step_workflow.md
- R05_cross_session_memory.md
- R06_contradictory_instructions.md
- R07_long_chain.md
- R08_debug_fix.md
- R09_data_cleaning.md
- R10_priority_triage.md
- TASK_TEMPLATE.md
- X01_constraint_satisfaction.md
- X02_hidden_pattern.md
- X03_strategic_reasoning.md
- X04_adversarial_code_review.md
- X05_counterfactual_reasoning.md
- X06_instruction_precision.md
- X07_self_correction.md
- X08_implicit_requirements.md
- X09_code_from_examples.md
- X10_nuanced_refusal.md
- .gitignore
- LICENSE
- README.de.md
- README.es.md
- README.fr.md
- README.it.md
- README.ja.md
- README.md
- README.ru.md
- README.zh-CN.md
// repository documentation
Was this content helpful?
(0 ratings)
