Propietario
TIGER-AI-Lab
12 repositorios indexados · Ver en GitHub
-
OpenResearcher
OpenResearcher: A Fully Open Pipeline for Long-Horizon Deep Research Trajectory Synthesis
Python · 1245 estrellas
-
verl-tool
A version of verl to support diverse tool use [TMLR 2026]
Python · 1041 estrellas
-
ClawBench
Open-source benchmark for browser AI agents on daily tasks.
Python · 795 estrellas
-
VLM2Vec
This repo contains the code for "VLM2Vec / MMEB" [ICLR 2025], "VLM2Vec-V2 / MMEB-V2" [TMLR 2026], and "MMEB-V3" [COLM 2026]
Python · 684 estrellas
-
ScholarCopilot
ScholarCopilot: Training Large Language Models for Academic Writing with Accurate Citations [COLM 2025]
Python · 252 estrellas
-
EditReward
EditReward: A Human-Aligned Reward Model for Instruction-Guided Image Editing [ICLR 2026]
Python · 160 estrellas
-
Context-Forcing
Context Forcing: Consistent Autoregressive Video Generation with Long Context [ICML26]
Python · 119 estrellas
-
RationalRewards
RationalRewards: a reasoning reward model for diffusion RL and test-time prompt tuning
Python · 61 estrellas
-
VideoScore2
Automatic Metric for Evaluating Generated Videos
Python · 58 estrellas
-
RewardHarness
Self-evolving agentic reward framework for image-editing evaluation — 47.4% on EditReward-Bench from only 100 preference demos, no reward...
Python · 54 estrellas
-
StructEval
Evaluating LLMs' abilities to generate structural output [TMLR2025]
Python · 23 estrellas
-
Python · 20 estrellas
-
سرچ در خصوص عنوان رساله دکتری Abierto
Dificultad 5/5 Más de una semana Aptitud para principiantes 10/100
TIGER-AI-Lab/OpenResearcher#11 · 1 comentario ·
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 75/100
TIGER-AI-Lab/ClawBench#380 ·
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 30/100
-
enhancement
Dificultad 5/5 Más de una semana Aptitud para principiantes 30/100
TIGER-AI-Lab/ClawBench#375 · 2 comentarios ·
-
enhancement
Dificultad 4/5 3-5 días Aptitud para principiantes 52/100
TIGER-AI-Lab/ClawBench#372 ·
-
enhancement
Dificultad 4/5 3-5 días Aptitud para principiantes 55/100
TIGER-AI-Lab/ClawBench#371 ·
-
publicity: turn the model leaderboard call-to-action into an evidence-based submission guide Abiertoenhancement
Dificultad 3/5 1-2 días Aptitud para principiantes 72/100
TIGER-AI-Lab/ClawBench#370 ·
-
enhancement
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
TIGER-AI-Lab/ClawBench#366 · 3 comentarios ·
-
bug
Dificultad 3/5 1-2 días Aptitud para principiantes 74/100
TIGER-AI-Lab/ClawBench#365 ·
-
bug
Dificultad 4/5 3-5 días Aptitud para principiantes 48/100
TIGER-AI-Lab/ClawBench#364 ·
-
bug
Dificultad 4/5 3-5 días Aptitud para principiantes 68/100
TIGER-AI-Lab/ClawBench#363 ·
-
bug
TIGER-AI-Lab/ClawBench#362 · 1 comentario · 1 asignado ·
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 32/100
TIGER-AI-Lab/ClawBench#359 ·
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 35/100
TIGER-AI-Lab/ClawBench#358 ·
-
Dificultad 4/5 3-5 días Aptitud para principiantes 66/100
TIGER-AI-Lab/ClawBench#357 ·
-
请问可以披露更多训练细节吗 Abierto
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
-
momentseeker数据不对 Abierto
Dificultad 4/5 3-5 días Aptitud para principiantes 15/100
TIGER-AI-Lab/VLM2Vec#212 ·
-
video.yaml配置不对 Abierto
Dificultad 3/5 1-2 días Aptitud para principiantes 35/100
TIGER-AI-Lab/VLM2Vec#211 ·
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
TIGER-AI-Lab/ClawBench#342 ·
-
memory.yaml配置文件 Abierto
Dificultad 3/5 1-2 días Aptitud para principiantes 35/100
TIGER-AI-Lab/VLM2Vec#210 ·
-
TIGER-AI-Lab/ClawBench#331 · 3 comentarios · 1 asignado ·
-
Dificultad 4/5 3-5 días Aptitud para principiantes 48/100
-
question
Dificultad 5/5 Más de una semana Aptitud para principiantes 35/100
TIGER-AI-Lab/ClawBench#317 · 2 comentarios ·
-
enhancement
TIGER-AI-Lab/ClawBench#309 · 1 comentario · 1 asignado ·
-
Dificultad 4/5 3-5 días Aptitud para principiantes 64/100
TIGER-AI-Lab/ClawBench#301 · 1 comentario ·
-
Dificultad 3/5 1-2 días Aptitud para principiantes 70/100
TIGER-AI-Lab/ClawBench#300 · 1 comentario ·
-
Dificultad 4/5 3-5 días Aptitud para principiantes 52/100
TIGER-AI-Lab/ClawBench#297 · 1 comentario ·
-
Dificultad 3/5 1-2 días Aptitud para principiantes 68/100
TIGER-AI-Lab/ClawBench#296 · 1 comentario ·
-
Verify evals on Papers with Code Abierto
Dificultad 2/5 1-3 horas Aptitud para principiantes 35/100
-
Verify evals on Papers with Code Abierto
Dificultad 1/5 1-3 horas Aptitud para principiantes 72/100
TIGER-AI-Lab/OpenResearcher#9 · 1 comentario ·
-
Verify evals on Papers with Code Abierto
Dificultad 3/5 1-2 días Aptitud para principiantes 48/100
-
Dificultad 1/5 Menos de una hora Aptitud para principiantes 62/100
-
Always report both Stage-1 (interception) and Stage-2 (judged); raw interception overcounts ~2× Abiertoenhancement
Dificultad 3/5 1-2 días Aptitud para principiantes 62/100
TIGER-AI-Lab/ClawBench#243 ·
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
TIGER-AI-Lab/OpenResearcher#8 · 4 comentarios ·
-
aggregation_threshold Abierto
Dificultad 3/5 1-2 días Aptitud para principiantes 45/100
TIGER-AI-Lab/EditReward#29 · 1 reacción ·
-
Data Annotation Format Issue Abierto
Dificultad 4/5 3-5 días Aptitud para principiantes 25/100
TIGER-AI-Lab/EditReward#28 ·
-
enhancement
Dificultad 4/5 3-5 días Aptitud para principiantes 48/100
TIGER-AI-Lab/ClawBench#188 · 1 comentario ·
-
feat: adapter — run Online-Mind2Web (live-web evolution of Mind2Web) under the ClawBench harness Abiertoenhancement
Dificultad 5/5 Más de una semana Aptitud para principiantes 35/100
TIGER-AI-Lab/ClawBench#189 ·
-
enhancement
Dificultad 5/5 Más de una semana Aptitud para principiantes 35/100
TIGER-AI-Lab/ClawBench#190 ·
-
enhancement
Dificultad 5/5 Más de una semana Aptitud para principiantes 42/100
TIGER-AI-Lab/ClawBench#169 ·
-
enhancement
Dificultad 5/5 Más de una semana Aptitud para principiantes 35/100
TIGER-AI-Lab/ClawBench#171 ·
-
v3 training data Abierto
Dificultad 3/5 1-2 días Aptitud para principiantes 52/100
TIGER-AI-Lab/VLM2Vec#203 ·
-
Dificultad 4/5 3-5 días Aptitud para principiantes 35/100
-
Dificultad 5/5 Más de una semana Aptitud para principiantes 35/100
TIGER-AI-Lab/ClawBench#160 ·
-
EVALUATE ONLY Abierto
Dificultad 5/5 Más de una semana Aptitud para principiantes 10/100
-
EVALUATION AND REDO Abierto
Dificultad 5/5 Más de una semana Aptitud para principiantes 20/100
TIGER-AI-Lab/ScholarCopilot#7 · 1 comentario ·
-
NEWEST DRADT HARKIS Abierto
Dificultad 1/5 Menos de una hora Aptitud para principiantes 55/100
TIGER-AI-Lab/ScholarCopilot#6 · 1 comentario ·
-
FEAT: support steel browser Abierto
Dificultad 4/5 3-5 días Aptitud para principiantes 35/100
TIGER-AI-Lab/ClawBench#105 ·
-
TIGER-AI-Lab/ClawBench#103 · 1 asignado ·
-
enhancement
Dificultad 5/5 Más de una semana Aptitud para principiantes 35/100
TIGER-AI-Lab/ClawBench#72 · 1 comentario ·