Hacktoberfest 2026: những issue maintainer đã đánh dấu cho tháng Mười, đang mở và phù hợp người mới. Xem issue Hacktoberfest

Always Block when train

Đang mở
#401 3 bình luận 0 reaction 0 người được giao Xem trên GitHub

Maintainer thường phản hồi trong vòng 1 ngày

Chưa có ai nhận issue này.

Đánh giá

Độ khó
4/5
Thời gian dự kiến
3-5 ngày
Mức phù hợp với người mới
25/100
Loại issue
Lỗi
Độ rõ ràng
Cần làm rõ
Mức độ hoạt động
Đình trệ
Công nghệ
python
Lĩnh vực
machine-learning

Hướng nghiên cứu

Bắt đầu trong train.py, đặc biệt là _calculate_logprobs, và kiểm tra quá trình xử lý các chunk được ghi log trong quá trình chạy huấn luyện. Tái hiện hành vi bị chặn đã được báo cáo và xác định tiến trình dừng ở đâu; issue không chỉ rõ bài kiểm thử hay hành vi mong đợi nào ngoài việc tránh bị chặn.

Do mô hình lập chỉ mục viết ra từ nội dung của issue.

Mô tả

bug

[train.py] _calculate_logprobs - Processing chunk 2168 to 2176
[train.py] _calculate_logprobs - Processing chunk 2176 to 2184
[train.py] _calculate_logprobs - Processing chunk 2184 to 2192
[train.py] _calculate_logprobs - Processing chunk 2192 to 2200
[train.py] _calculate_logprobs - Processing chunk 2200 to 2208
[train.py] _calculate_logprobs - Processing chunk 2208 to 2216
[train.py] _calculate_logprobs - Processing chunk 2216 to 2224
[train.py] _calculate_logprobs - Processing chunk 10152 to 10160
[train.py] _calculate_logprobs - Processing chunk 10160 to 10168
[train.py] _calculate_logprobs - Processing chunk 10168 to 10176
[train.py] _calculate_logprobs - Processing chunk 10176 to 10184
[train.py] _calculate_logprobs - Processing chunk 10184 to 10192
[train.py] calculate_logprobs - Processing chunk 10192 to 10200
[train.py] calculate_logprobs - Processing chunk 10200 to 10208
[train.py] calculate_logprobs - Processing chunk 10208 to 10216
[train.py] calculate_logprobs - Processing chunk 10216 to 10224
==((====))== Unsloth - 2x faster free finetuning | Num GPUs used = 1
\ /| Num examples = 10,000,000 | Num Epochs = 3 | Total steps = 60,000,000
O^O/ _/ \ Batch size per device = 1 | Gradient accumulation steps = 1
\ / Data Parallel GPUs = 1 | Total batch size (1 x 1 x 1) = 1
"-
-" Trainable parameters = 20,185,088 of 7,635,801,600 (0.26% trained)

DEBUG:urllib3.connectionpool:Resetting dropped connection: stats.vllm.ai
DEBUG:urllib3.connectionpool:https://stats.vllm.ai:443 "POST / HTTP/1.1" 200 None

Ngôn ngữ chính
Python
Star
10.8k
Fork
997
Merge trung bình
10 giờ 1 phút
Pull request đã merge (30 ngày)
117

Chuẩn bị môi trường

Bắt đầu từ đâu

  1. Đọc hết issue, rồi đọc hướng dẫn đóng góp của dự án.
  2. Bình luận trên issue rằng bạn sẽ nhận — tránh hai người làm cùng một việc.
  3. Fork repository và làm thay đổi trên một nhánh.
  4. Mở pull request có tham chiếu số hiệu của issue.

Issue khác của OpenPipe/ART

Tất cả issue của OpenPipe/ART

Issue tương tự

Thêm issue về Python

Nhận issue mới trong hộp thư của bạn

Bản tóm tắt ngắn những issue GitHub phù hợp với người mới.