Owner
TIGER-AI-Lab
10 indexed repositories · View on GitHub
-
verl-tool
A version of verl to support diverse tool use [TMLR 2026]
Python · 1041 stars
-
ClawBench
Open-source benchmark for browser AI agents on daily tasks.
Python · 795 stars
-
VLM2Vec
This repo contains the code for "VLM2Vec / MMEB" [ICLR 2025], "VLM2Vec-V2 / MMEB-V2" [TMLR 2026], and "MMEB-V3" [COLM 2026]
Python · 684 stars
-
ScholarCopilot
ScholarCopilot: Training Large Language Models for Academic Writing with Accurate Citations [COLM 2025]
Python · 252 stars
-
EditReward
EditReward: A Human-Aligned Reward Model for Instruction-Guided Image Editing [ICLR 2026]
Python · 160 stars
-
Context-Forcing
Context Forcing: Consistent Autoregressive Video Generation with Long Context [ICML26]
Python · 119 stars
-
VideoScore2
Automatic Metric for Evaluating Generated Videos
Python · 58 stars
-
RewardHarness
Self-evolving agentic reward framework for image-editing evaluation — 47.4% on EditReward-Bench from only 100 preference demos, no reward...
Python · 54 stars
-
StructEval
Evaluating LLMs' abilities to generate structural output [TMLR2025]
Python · 23 stars
-
Python · 20 stars
-
enhancement
Difficulty 5/5 Over a week Newbie friendliness 30/100
TIGER-AI-Lab/ClawBench#375 · 2 comments ·
-
enhancement
Difficulty 4/5 3-5 days Newbie friendliness 52/100
TIGER-AI-Lab/ClawBench#372 ·
-
enhancement
Difficulty 4/5 3-5 days Newbie friendliness 55/100
TIGER-AI-Lab/ClawBench#371 ·
-
enhancement
Difficulty 3/5 1-2 days Newbie friendliness 72/100
TIGER-AI-Lab/ClawBench#370 ·
-
enhancement
Difficulty 5/5 Over a week Newbie friendliness 25/100
TIGER-AI-Lab/ClawBench#366 · 3 comments ·
-
bug
Difficulty 3/5 1-2 days Newbie friendliness 74/100
TIGER-AI-Lab/ClawBench#365 ·
-
bug
Difficulty 4/5 3-5 days Newbie friendliness 48/100
TIGER-AI-Lab/ClawBench#364 ·
-
bug
Difficulty 4/5 3-5 days Newbie friendliness 68/100
TIGER-AI-Lab/ClawBench#363 ·
-
bug
TIGER-AI-Lab/ClawBench#362 · 1 comment · 1 assignee ·
-
Difficulty 5/5 Over a week Newbie friendliness 32/100
TIGER-AI-Lab/ClawBench#359 ·
-
Difficulty 5/5 Over a week Newbie friendliness 35/100
TIGER-AI-Lab/ClawBench#358 ·
-
Difficulty 4/5 3-5 days Newbie friendliness 66/100
TIGER-AI-Lab/ClawBench#357 ·
-
momentseeker数据不对 Open
Difficulty 4/5 3-5 days Newbie friendliness 15/100
TIGER-AI-Lab/VLM2Vec#212 ·
-
video.yaml配置不对 Open
Difficulty 3/5 1-2 days Newbie friendliness 35/100
TIGER-AI-Lab/VLM2Vec#211 ·
-
Difficulty 5/5 Over a week Newbie friendliness 25/100
TIGER-AI-Lab/ClawBench#342 ·
-
memory.yaml配置文件 Open
Difficulty 3/5 1-2 days Newbie friendliness 35/100
TIGER-AI-Lab/VLM2Vec#210 ·
-
TIGER-AI-Lab/ClawBench#331 · 3 comments · 1 assignee ·
-
Difficulty 4/5 3-5 days Newbie friendliness 48/100
-
question
Difficulty 5/5 Over a week Newbie friendliness 35/100
TIGER-AI-Lab/ClawBench#317 · 2 comments ·
-
enhancement
TIGER-AI-Lab/ClawBench#309 · 1 comment · 1 assignee ·
-
Difficulty 4/5 3-5 days Newbie friendliness 64/100
TIGER-AI-Lab/ClawBench#301 · 1 comment ·
-
Difficulty 3/5 1-2 days Newbie friendliness 70/100
TIGER-AI-Lab/ClawBench#300 · 1 comment ·
-
Difficulty 4/5 3-5 days Newbie friendliness 52/100
TIGER-AI-Lab/ClawBench#297 · 1 comment ·
-
Difficulty 3/5 1-2 days Newbie friendliness 68/100
TIGER-AI-Lab/ClawBench#296 · 1 comment ·
-
Difficulty 3/5 1-2 days Newbie friendliness 48/100
-
Difficulty 1/5 Under an hour Newbie friendliness 62/100
-
Always report both Stage-1 (interception) and Stage-2 (judged); raw interception overcounts ~2× Openenhancement
Difficulty 3/5 1-2 days Newbie friendliness 62/100
TIGER-AI-Lab/ClawBench#243 ·
-
Difficulty 3/5 1-2 days Newbie friendliness 45/100
TIGER-AI-Lab/EditReward#29 · 1 reaction ·
-
Difficulty 4/5 3-5 days Newbie friendliness 25/100
TIGER-AI-Lab/EditReward#28 ·
-
enhancement
Difficulty 4/5 3-5 days Newbie friendliness 48/100
TIGER-AI-Lab/ClawBench#188 ·
-
feat: adapter — run Online-Mind2Web (live-web evolution of Mind2Web) under the ClawBench harness Openenhancement
Difficulty 5/5 Over a week Newbie friendliness 35/100
TIGER-AI-Lab/ClawBench#189 ·
-
enhancement
Difficulty 5/5 Over a week Newbie friendliness 35/100
TIGER-AI-Lab/ClawBench#190 ·
-
enhancement
Difficulty 5/5 Over a week Newbie friendliness 42/100
TIGER-AI-Lab/ClawBench#169 ·
-
enhancement
Difficulty 5/5 Over a week Newbie friendliness 35/100
TIGER-AI-Lab/ClawBench#171 ·
-
v3 training data Open
Difficulty 3/5 1-2 days Newbie friendliness 52/100
TIGER-AI-Lab/VLM2Vec#203 ·
-
Difficulty 4/5 3-5 days Newbie friendliness 35/100
-
Difficulty 5/5 Over a week Newbie friendliness 35/100
TIGER-AI-Lab/ClawBench#160 ·
-
EVALUATE ONLY Open
Difficulty 5/5 Over a week Newbie friendliness 10/100
-
EVALUATION AND REDO Open
Difficulty 5/5 Over a week Newbie friendliness 20/100
TIGER-AI-Lab/ScholarCopilot#7 · 1 comment ·
-
NEWEST DRADT HARKIS Open
Difficulty 1/5 Under an hour Newbie friendliness 55/100
TIGER-AI-Lab/ScholarCopilot#6 · 1 comment ·
-
Difficulty 4/5 3-5 days Newbie friendliness 35/100
TIGER-AI-Lab/ClawBench#105 ·
-
TIGER-AI-Lab/ClawBench#103 · 1 assignee ·
-
enhancement
Difficulty 5/5 Over a week Newbie friendliness 35/100
TIGER-AI-Lab/ClawBench#72 · 1 comment ·
-
评估支持使用vllm框架部署的模型吗 Open
Difficulty 4/5 3-5 days Newbie friendliness 30/100
TIGER-AI-Lab/VLM2Vec#200 ·
-
About LORA Open
Difficulty 2/5 1-3 hours Newbie friendliness 65/100
TIGER-AI-Lab/verl-tool#154 ·
-
Difficulty 4/5 3-5 days Newbie friendliness 25/100
-
Difficulty 5/5 Over a week Newbie friendliness 20/100
TIGER-AI-Lab/verl-tool#151 ·
-
Difficulty 4/5 3-5 days Newbie friendliness 35/100
TIGER-AI-Lab/VLM2Vec#194 · 2 comments ·
-
Difficulty 5/5 Over a week Newbie friendliness 20/100
TIGER-AI-Lab/VLM2Vec#193 ·
-
Difficulty 3/5 1-2 days Newbie friendliness 35/100
TIGER-AI-Lab/EditReward#25 · 1 comment ·