Respan Dataset Explorer
Select one behavior. Every returned turn has one binary label: Present or Absent. Source: final dense boolean release.
5,167,182physical rows
86shards
0.00%qualified row coverage
0.00%qualified cell coverage
turns-00075.parquet:35282
bee57bb02c5e04addcbc88ab
turn 1/1gpt-4.1-mini-2025-04-14VietnameseUnited States258 words
degenerate_repetitionAbsentFinal dense release
USER
Bạn là một mô hình thẩm phán (judge) trong một hệ thống chấm điểm khả năng gọi hàm (function calling) của một mô hình nhỏ hơn.
Bạn sẽ nhận một câu hỏi người dùng, một danh sách các hàm có sẵn, và đầu ra của mô hình.
Nhiệm vụ của bạn là đánh giá liệu mô hình nhỏ hơn có thể tạo ra các lời gọi hàm chính xác không,
đồng thời cung cấp một điểm số dựa trên tính chính xác và đầy đủ của câu trả lời.
Câu hỏi người dùng:
Find the compatibility score in percentage of Aries with Gemini.
Danh sách các hàm có sẵn:
[{"name": "get_zodiac_compatibility", "description": "Retrieve the compatibility score between two Zodiac signs.", "parameters": {"type": "object", "properties": {"sign1": {"type": "string", "description": "The first Zodiac sign."}, "sign2": {"type": "string", "description": "The second Zodiac sign."}, "scale": {"type": "string", "enum": ["percentage", "0-10 scale"], "description": "The scale on which compatibility should be shown. Default is 'percentage'."}}, "required": ["sign1", "sign2"]}}]
Đầu ra của mô hình nhỏ hơn:
<tool_call>
{"name": "get_zodiac_compatibility", "arguments": {"sign1": "Aries", "sign2": "Gemini", "scale": "percentage"}}
</tool_call>
Đánh giá đầu ra dựa trên các tiêu chí sau:
1. Chính xác (0-10 điểm)
2. Thứ tự gọi hàm (0-10 điểm)
Lưu ý: Nếu không có hàm nào phù hợp, mô hình có thể từ chối gọi hàm hoặc trả về hàm rỗng vẫn được tính điểm chính xác.
Chỉ trả về JSON theo định dạng:
{
"correct": <điểm chính xác>,
"function_order": <điểm thứ tự>,
"total_score": <tổng điểm>
}ASSISTANT
{
"correct": 10,
"function_order": 10,
"total_score": 20
}
turns-00075.parquet:35283
1e20d0f244125a7ffea97661
turn 1/1gpt-4.1-mini-2025-04-14Arabicunknown country15 words
degenerate_repetitionAbsentFinal dense release
ASSISTANT
حسنًا! إليك سؤالي الأول لك:
ما هي هوايتك المفضلة ولماذا تحبها؟
turns-00075.parquet:35284
918d6f295ee37d415274df00
turn 1/1gpt-4.1-mini-2025-04-14VietnameseUnited States253 words
degenerate_repetitionAbsentFinal dense release
USER
Bạn là một mô hình thẩm phán (judge) trong một hệ thống chấm điểm khả năng gọi hàm (function calling) của một mô hình nhỏ hơn.
Bạn sẽ nhận một câu hỏi người dùng, một danh sách các hàm có sẵn, và đầu ra của mô hình.
Nhiệm vụ của bạn là đánh giá liệu mô hình nhỏ hơn có thể tạo ra các lời gọi hàm chính xác không,
đồng thời cung cấp một điểm số dựa trên tính chính xác và đầy đủ của câu trả lời.
Câu hỏi người dùng:
Get me strength and weakness traits for ENFJ personality type.
Danh sách các hàm có sẵn:
[{"name": "get_personality_traits", "description": "Retrieve the personality traits for a specific personality type, including their strengths and weaknesses.", "parameters": {"type": "object", "properties": {"type": {"type": "string", "description": "The personality type."}, "traits": {"type": "array", "items": {"type": "string", "enum": ["strengths", "weaknesses"]}, "description": "List of traits to be retrieved, default is ['strengths']."}}, "required": ["type"]}}]
Đầu ra của mô hình nhỏ hơn:
```
[{'name': 'get_personality_traits', 'arguments': {'type': 'ENFJ', 'traits': ['strengths', 'weaknesses']}}]
```
Đánh giá đầu ra dựa trên các tiêu chí sau:
1. Chính xác (0-10 điểm)
2. Thứ tự gọi hàm (0-10 điểm)
Lưu ý: Nếu không có hàm nào phù hợp, mô hình có thể từ chối gọi hàm hoặc trả về hàm rỗng vẫn được tính điểm chính xác.
Chỉ trả về JSON theo định dạng:
{
"correct": <điểm chính xác>,
"function_order": <điểm thứ tự>,
"total_score": <tổng điểm>
}ASSISTANT
{
"correct": 10,
"function_order": 10,
"total_score": 20
}
turns-00075.parquet:35285
6a2e3749ccaa8cfb80dc2954
turn 1/1gpt-4.1-mini-2025-04-14Englishunknown country14 words
degenerate_repetitionAbsentFinal dense release
USER
User: say hi
User: say hi
Assistant:
ASSISTANT
Hi! How can I help you today?
turns-00075.parquet:35286
ef7e9ac0bd4969585e989e82
turn 1/1gpt-4.1-mini-2025-04-14VietnameseUnited States253 words
degenerate_repetitionAbsentFinal dense release
USER
Bạn là một mô hình thẩm phán (judge) trong một hệ thống chấm điểm khả năng gọi hàm (function calling) của một mô hình nhỏ hơn.
Bạn sẽ nhận một câu hỏi người dùng, một danh sách các hàm có sẵn, và đầu ra của mô hình.
Nhiệm vụ của bạn là đánh giá liệu mô hình nhỏ hơn có thể tạo ra các lời gọi hàm chính xác không,
đồng thời cung cấp một điểm số dựa trên tính chính xác và đầy đủ của câu trả lời.
Câu hỏi người dùng:
Get me strength and weakness traits for ENFJ personality type.
Danh sách các hàm có sẵn:
[{"name": "get_personality_traits", "description": "Retrieve the personality traits for a specific personality type, including their strengths and weaknesses.", "parameters": {"type": "object", "properties": {"type": {"type": "string", "description": "The personality type."}, "traits": {"type": "array", "items": {"type": "string", "enum": ["strengths", "weaknesses"]}, "description": "List of traits to be retrieved, default is ['strengths']."}}, "required": ["type"]}}]
Đầu ra của mô hình nhỏ hơn:
<tool_call>
{"name": "get_personality_traits", "arguments": {"type": "ENFJ", "traits": ["strengths", "weaknesses"]}}
</tool_call>
Đánh giá đầu ra dựa trên các tiêu chí sau:
1. Chính xác (0-10 điểm)
2. Thứ tự gọi hàm (0-10 điểm)
Lưu ý: Nếu không có hàm nào phù hợp, mô hình có thể từ chối gọi hàm hoặc trả về hàm rỗng vẫn được tính điểm chính xác.
Chỉ trả về JSON theo định dạng:
{
"correct": <điểm chính xác>,
"function_order": <điểm thứ tự>,
"total_score": <tổng điểm>
}ASSISTANT
{
"correct": 10,
"function_order": 10,
"total_score": 20
}
turns-00075.parquet:35287
7d7434fa1e035e4686978a91
turn 1/1gpt-4.1-mini-2025-04-14VietnameseUnited States248 words
degenerate_repetitionAbsentFinal dense release
USER
Bạn là một mô hình thẩm phán (judge) trong một hệ thống chấm điểm khả năng gọi hàm (function calling) của một mô hình nhỏ hơn.
Bạn sẽ nhận một câu hỏi người dùng, một danh sách các hàm có sẵn, và đầu ra của mô hình.
Nhiệm vụ của bạn là đánh giá liệu mô hình nhỏ hơn có thể tạo ra các lời gọi hàm chính xác không,
đồng thời cung cấp một điểm số dựa trên tính chính xác và đầy đủ của câu trả lời.
Câu hỏi người dùng:
Find three personality traits of people who like jogging.
Danh sách các hàm có sẵn:
[{"name": "get_personality_traits", "description": "Retrieve the common personality traits of people based on their hobbies or activities.", "parameters": {"type": "object", "properties": {"hobby": {"type": "string", "description": "The hobby or activity of interest."}, "trait_count": {"type": "integer", "description": "The number of top traits to return, default is 5"}}, "required": ["hobby"]}}]
Đầu ra của mô hình nhỏ hơn:
```
[{'name': 'get_personality_traits', 'arguments': {'hobby': 'jogging', 'trait_count': 3}}]
```
Đánh giá đầu ra dựa trên các tiêu chí sau:
1. Chính xác (0-10 điểm)
2. Thứ tự gọi hàm (0-10 điểm)
Lưu ý: Nếu không có hàm nào phù hợp, mô hình có thể từ chối gọi hàm hoặc trả về hàm rỗng vẫn được tính điểm chính xác.
Chỉ trả về JSON theo định dạng:
{
"correct": <điểm chính xác>,
"function_order": <điểm thứ tự>,
"total_score": <tổng điểm>
}ASSISTANT
{
"correct": 10,
"function_order": 10,
"total_score": 20
}
turns-00075.parquet:35288
643cc2f01df118f004307d83
turn 1/1gpt-4.1-mini-2025-04-14VietnameseUnited States248 words
degenerate_repetitionAbsentFinal dense release
USER
Bạn là một mô hình thẩm phán (judge) trong một hệ thống chấm điểm khả năng gọi hàm (function calling) của một mô hình nhỏ hơn.
Bạn sẽ nhận một câu hỏi người dùng, một danh sách các hàm có sẵn, và đầu ra của mô hình.
Nhiệm vụ của bạn là đánh giá liệu mô hình nhỏ hơn có thể tạo ra các lời gọi hàm chính xác không,
đồng thời cung cấp một điểm số dựa trên tính chính xác và đầy đủ của câu trả lời.
Câu hỏi người dùng:
Find three personality traits of people who like jogging.
Danh sách các hàm có sẵn:
[{"name": "get_personality_traits", "description": "Retrieve the common personality traits of people based on their hobbies or activities.", "parameters": {"type": "object", "properties": {"hobby": {"type": "string", "description": "The hobby or activity of interest."}, "trait_count": {"type": "integer", "description": "The number of top traits to return, default is 5"}}, "required": ["hobby"]}}]
Đầu ra của mô hình nhỏ hơn:
<tool_call>
{"name": "get_personality_traits", "arguments": {"hobby": "jogging", "trait_count": 3}}
</tool_call>
Đánh giá đầu ra dựa trên các tiêu chí sau:
1. Chính xác (0-10 điểm)
2. Thứ tự gọi hàm (0-10 điểm)
Lưu ý: Nếu không có hàm nào phù hợp, mô hình có thể từ chối gọi hàm hoặc trả về hàm rỗng vẫn được tính điểm chính xác.
Chỉ trả về JSON theo định dạng:
{
"correct": <điểm chính xác>,
"function_order": <điểm thứ tự>,
"total_score": <tổng điểm>
}ASSISTANT
{
"correct": 10,
"function_order": 10,
"total_score": 20
}
turns-00075.parquet:35289
41e549592c6876e7a5ab1b2f
turn 1/1gpt-4.1-mini-2025-04-14EnglishUnited States21 words
degenerate_repetitionAbsentFinal dense release
USER
User: Hi, what's up?
User: Hi, what's up?
Assistant:
ASSISTANT
Hello! Not much, just here and ready to help. How about you?
turns-00075.parquet:35290
63650dd97169c16fe03e45d1
turn 1/1gpt-4.1-mini-2025-04-14EnglishMexico23 words
degenerate_repetitionAbsentFinal dense release
USER
User: hi, how are you?
User: hi, how are you?
Assistant:
ASSISTANT
Hello! I'm doing well, thank you. How can I assist you today?
turns-00075.parquet:35291
bb8d0885be449c86b06e2859
turn 1/1gpt-4.1-mini-2025-04-14VietnameseUnited States260 words
degenerate_repetitionAbsentFinal dense release
USER
Bạn là một mô hình thẩm phán (judge) trong một hệ thống chấm điểm khả năng gọi hàm (function calling) của một mô hình nhỏ hơn.
Bạn sẽ nhận một câu hỏi người dùng, một danh sách các hàm có sẵn, và đầu ra của mô hình.
Nhiệm vụ của bạn là đánh giá liệu mô hình nhỏ hơn có thể tạo ra các lời gọi hàm chính xác không,
đồng thời cung cấp một điểm số dựa trên tính chính xác và đầy đủ của câu trả lời.
Câu hỏi người dùng:
What's my Big Five Personality trait scores given that I am efficient, organized, easy going and compassionate?
Danh sách các hàm có sẵn:
[{"name": "get_bigfive_scores", "description": "Retrieve Big Five Personality trait scores based on individual's behavioural characteristics.", "parameters": {"type": "object", "properties": {"characteristics": {"type": "array", "items": {"type": "string"}, "description": "List of user's behavioural characteristics."}, "scale": {"type": "string", "enum": ["high", "medium", "low"], "description": "The scoring scale of traits (default is medium)."}}, "required": ["characteristics"]}}]
Đầu ra của mô hình nhỏ hơn:
```
[{'name': 'get_bigfive_scores', 'arguments': {'characteristics': ['efficient', 'organized', 'easy going', 'compassionate']}}]
```
Đánh giá đầu ra dựa trên các tiêu chí sau:
1. Chính xác (0-10 điểm)
2. Thứ tự gọi hàm (0-10 điểm)
Lưu ý: Nếu không có hàm nào phù hợp, mô hình có thể từ chối gọi hàm hoặc trả về hàm rỗng vẫn được tính điểm chính xác.
Chỉ trả về JSON theo định dạng:
{
"correct": <điểm chính xác>,
"function_order": <điểm thứ tự>,
"total_score": <tổng điểm>
}ASSISTANT
{
"correct": 10,
"function_order": 10,
"total_score": 20
}