File size: 12,611 Bytes
f52a1d4 | 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31 32 33 34 35 36 37 38 39 40 41 42 43 44 45 46 47 48 49 50 51 52 53 54 55 56 57 58 59 60 61 62 63 64 65 66 67 68 69 70 71 72 73 74 75 76 77 78 79 80 81 82 83 84 85 86 87 88 89 90 91 92 93 94 95 96 97 98 99 100 101 102 103 104 105 106 107 108 109 110 111 112 113 114 115 116 117 118 119 120 121 122 123 124 125 126 127 128 129 130 131 132 133 134 135 136 137 138 139 140 141 142 143 144 145 146 147 148 149 150 151 152 153 154 155 156 157 158 159 160 161 162 163 164 165 166 167 168 169 170 171 172 173 174 175 176 177 178 179 180 181 182 183 184 185 186 187 188 189 190 191 192 193 194 195 196 197 198 199 200 201 202 203 204 205 206 207 208 209 210 211 212 213 214 215 216 217 218 219 220 221 222 223 224 225 226 227 228 229 230 231 232 233 234 235 236 237 238 239 240 241 242 243 244 245 246 247 248 249 250 251 252 253 254 255 256 257 258 259 260 261 262 263 264 265 266 267 268 269 270 271 272 273 274 275 276 277 278 279 280 281 282 283 284 285 286 287 288 289 290 | from dataclasses import asdict
from collections import deque
from typing import Dict, Callable, Any
import torch
import numpy as np
import cv2
import rospy
from tqdm import tqdm
import time
import sys
from kuavo_deploy.config import KuavoConfig
from sensor_msgs.msg import CompressedImage, JointState
from torchvision.transforms.functional import to_tensor
from kuavo_humanoid_sdk.msg.kuavo_msgs.msg import sensorsData,lejuClawState
from kuavo_deploy.utils.signal_controller import ControlSignalManager
from kuavo_deploy.utils.logging_utils import setup_logger
from kuavo_deploy.utils.ros_manager import ROSManager
from kuavo_data.common.config_platform import get_arm_joint_slice
log_robot = setup_logger("robot")
class ObsBuffer:
def __init__(
self,
config: KuavoConfig,
obs_key_map: Dict[str, Dict[str, Any]] = None,
compute_func_map: Dict[str, Callable] = None,
) -> None:
self.control_signal_manager = ControlSignalManager()
self.ros_manager = ROSManager()
# === 从 KuavoConfig 中提取环境配置 ===
# env_cfg = config.env
env_cfg = config
self.which_arm = env_cfg.which_arm
self.platform_type = env_cfg.platform_type
# === 观测定义 ===
self.obs_key_map = obs_key_map or env_cfg.obs_key_map or {}
self.compute_func_map = compute_func_map or {}
# === 区分订阅型与计算型观测 ===
self.subscribe_keys = {k: v for k, v in self.obs_key_map.items() if v.get("type") != "computed"}
self.computed_keys = {k: v for k, v in self.obs_key_map.items() if v.get("type") == "computed"}
# === 反向依赖索引 ===
self.source_to_computed = {}
for comp_key, comp_info in self.computed_keys.items():
src = comp_info.get("source")
if src:
self.source_to_computed.setdefault(src, []).append(comp_key)
log_robot.info(f"Registered computed obs '{comp_key}' depends on '{src}'")
# === 初始化观测缓存 ===
self.obs_buffer_size = {k: v["frequency"] for k, v in self.obs_key_map.items()}
self.obs_buffer_data = {
k: {"data": deque(maxlen=v["frequency"]), "timestamp": deque(maxlen=v["frequency"])}
for k, v in self.obs_key_map.items()
}
# === ROS topic 对应表 ===
self.callback_key_map = {
'/cam_h/color/image_raw/compressed': self.rgb_callback,
'/cam_l/color/image_raw/compressed': self.rgb_callback,
'/cam_r/color/image_raw/compressed': self.rgb_callback,
'/cam_h/depth/image_raw/compressedDepth': self.depth_callback,
'/cam_l/depth/image_rect_raw/compressedDepth': self.depth_callback,
'/cam_r/depth/image_rect_raw/compressedDepth': self.depth_callback,
'/sensors_data_raw': self.sensorsData_callback,
'/dexhand/state': self.qiangnaoState_callback,
'/leju_claw_state': self.lejuClawState_callback,
'/gripper/state': self.rq2f85State_callback,
}
self.setup_subscribers()
# ===== ROS订阅 =====
def create_callback(self, callback, topic_key, handle):
return lambda msg: callback(msg, topic_key, handle)
def setup_subscribers(self):
"""仅订阅来自 ROS 的观测"""
msg_type_dict = {"CompressedImage":CompressedImage,
"sensorsData":sensorsData,
"JointState":JointState,
"lejuClawState":lejuClawState}
for topic_key, info in self.subscribe_keys.items():
topic_name = info["topic"]
assert info["msg_type"] in msg_type_dict, f"msg_type '{info['msg_type']}' is not supported; valid keys: {list(msg_type_dict.keys())}"
msg_type = msg_type_dict[info["msg_type"]]
callback = self.callback_key_map.get(topic_name)
if not msg_type or not callback:
log_robot.warning(f"Missing msg_type or callback for {topic_name}")
continue
handle = info.get("handle", {})
self.ros_manager.register_subscriber(
topic_name, msg_type, self.create_callback(callback, topic_key, handle)
)
log_robot.info(f"Subscribed to {topic_name} for key '{topic_key}'")
# ===== 数据预处理 =====
def img_preprocess(self, image):
"""图像预处理"""
return to_tensor(image).unsqueeze(0)
def depth_preprocess(self, depth, depth_range=[0, 1500]):
"""深度图像预处理"""
depth_float32 = depth.astype(np.float32)
depth_float32 = torch.tensor(depth_float32, dtype=torch.float32).clamp(*depth_range).unsqueeze(0)
max_depth = depth_float32.max()
min_depth = depth_float32.min()
depth_normalized = (depth_float32 - min_depth) / (max_depth - min_depth + 1e-9)
return depth_normalized
# ===== Callback 函数群 =====
def rgb_callback(self, msg: CompressedImage, key: str, handle: dict):
img_arr = np.frombuffer(msg.data, dtype=np.uint8)
cv_img = cv2.imdecode(img_arr, cv2.IMREAD_COLOR)
if cv_img is None:
raise ValueError("Failed to decode compressed image")
cv_img = cv2.cvtColor(cv_img, cv2.COLOR_BGR2RGB)
resize_wh = handle.get("params", {}).get("resize_wh", None)
if resize_wh:
cv_img = cv2.resize(cv_img, resize_wh)
data = self.img_preprocess(cv_img)
self._append_data(key, data, msg.header.stamp.to_sec())
def depth_callback(self, msg: CompressedImage, key: str, handle: dict):
png_magic = bytes([137, 80, 78, 71, 13, 10, 26, 10])
idx = msg.data.find(png_magic)
if idx == -1:
raise ValueError("Invalid depth message, PNG header not found")
np_arr = np.frombuffer(msg.data[idx:], np.uint8)
image = cv2.imdecode(np_arr, cv2.IMREAD_UNCHANGED)
if image is None:
return
resize_wh = handle.get("params", {}).get("resize_wh", None)
if resize_wh:
image = cv2.resize(image, resize_wh)
image = image[np.newaxis, ...]
data = self.depth_preprocess(image, depth_range=handle.get("params", {}).get("depth_range", [0, 1500]))
self._append_data(key, data, msg.header.stamp.to_sec())
def sensorsData_callback(self, msg: sensorsData, key: str, handle = dict):
# Float64Array ()
joint = msg.joint_data.joint_q
timestamp = msg.header.stamp.to_sec()
# FK 计算需要双臂的14个关节(索引12-26)
# 计算依赖于此数据源的观测(例如 eef_pose)
arm_start, arm_end = get_arm_joint_slice(self.platform_type)
arm_joints = joint[arm_start:arm_end] # 提取双臂关节
self.compute_dependent_obs(key, arm_joints, timestamp)
slice_value = handle.get("params", {}).get("slice", None)
joint = [x for slc in slice_value for x in joint[slc[0]:slc[1]]]
# joint = torch.tensor(joint, dtype=torch.float32, device=self.device)
self._append_data(key, joint, timestamp)
def lejuClawState_callback(self, msg: lejuClawState, key: str, handle = dict):
# Float64Array ()
joint = msg.data.position
slice_value = handle.get("params", {}).get("slice", None)
joint = [x / 100 for slc in slice_value for x in joint[slc[0]:slc[1]]] # 注意缩放
# joint = torch.tensor(joint, dtype=torch.float32, device=self.device)
self._append_data(key, joint, msg.header.stamp.to_sec())
def qiangnaoState_callback(self, msg: JointState, key: str, handle = dict):
joint = msg.position
joint = [figure / 100 for figure in joint]
slice_value = handle.get("params", {}).get("slice", None)
joint = [x for slc in slice_value for x in joint[slc[0]:slc[1]]]
# joint = torch.tensor(joint, dtype=torch.float32, device=self.device)
self._append_data(key, joint, msg.header.stamp.to_sec())
def rq2f85State_callback(self, msg: JointState, key: str, handle = dict):
joint = msg.position
joint = [figure / 0.8 for figure in joint]
slice_value = handle.get("params", {}).get("slice", None)
joint = [x for slc in slice_value for x in joint[slc[0]:slc[1]]]
# joint = torch.tensor(joint, dtype=torch.float32, device=self.device)
self._append_data(key, joint, msg.header.stamp.to_sec())
# ===== 公共方法 =====
def _append_data(self, key, data, timestamp):
self.obs_buffer_data[key]["data"].append(data)
self.obs_buffer_data[key]["timestamp"].append(timestamp)
def compute_dependent_obs(self, source_key, source_data, timestamp):
for comp_key in self.source_to_computed.get(source_key, []):
func = self.compute_func_map.get(comp_key)
if not func:
log_robot.warning(f"No compute function for {comp_key}")
continue
try:
data = func(source_data, which_arm=self.which_arm)
if data is not None:
self._append_data(comp_key, data, timestamp)
except Exception as e:
log_robot.error(f"Error computing {comp_key} from {source_key}: {e}")
def obs_buffer_is_ready(self):
return all(len(self.obs_buffer_data[k]["data"]) == self.obs_key_map[k]["frequency"] for k in self.obs_key_map)
def stop_subscribers(self):
self.ros_manager.close()
def wait_buffer_ready(self):
progress = {k: 0 for k in self.obs_key_map}
total = {k: v["frequency"] for k, v in self.obs_key_map.items()}
last_log_time = 0
while not self.obs_buffer_is_ready():
if not self.control_signal_manager.check_control_signals():
log_robot.info("🛑 停止信号已接收,退出")
sys.exit(1)
now = time.time()
# 每隔 1 秒打印一次日志
if now - last_log_time > 0.2:
logs = []
for k in progress:
new_len = len(self.obs_buffer_data[k]["data"])
progress[k] = new_len
logs.append(f"{k}: {new_len}/{total[k]}")
log_robot.info(" | ".join(logs))
last_log_time = now
time.sleep(0.1)
log_robot.info("✅ All buffers ready!")
return True
def get_latest_obs(self):
obs = {}
for k, buf in self.obs_buffer_data.items():
obs[k] = list(buf["data"])[-1] # 取最新一帧
return obs
def get_aligned_obs(self, reference_keys=["/cam_h/color/image_raw/compressed"], max_dt=0.01, ratio=1.0):
"""
返回各观测时间上对齐的最新帧
reference_keys: 以哪些key作为时间参考,默认 None -> 所有 key 最小的最新时间戳
max_dt: 最大允许时间偏差(秒),超出则返回 None
"""
# ===== 获取参考时间戳 =====
if reference_keys:
# 用指定 key 的最新时间戳
ref_times = []
for k in reference_keys:
buf = self.obs_buffer_data[k]
if len(buf) == 0:
continue
_, ts = buf["data"], buf["timestamp"]
ref_times.append(ts[-1])
if not ref_times:
return None
ref_time = min(ref_times) # 也可以取 min 或 max,根据需要
else:
# 没有指定 key -> 所有观测的最新 timestamp 的最小值
last_timestamps = []
for buf in self.obs_buffer_data.values():
if len(buf) == 0:
continue
_, ts = buf["data"], buf["timestamp"]
last_timestamps.append(ts[-1])
if not last_timestamps:
return None
ref_time = np.min(last_timestamps)
# ===== 对齐各观测 =====
aligned_obs = {}
for k, buf in self.obs_buffer_data.items():
n = int(len(buf["data"]) * ratio)
data, ts = list(buf["data"])[-n:], list(buf["timestamp"])[-n:]
ts = np.array(ts)
if len(ts) == 0:
aligned_obs[k] = None
continue
idx = np.argmin(np.abs(ts - ref_time))
if abs(ts[idx] - ref_time) > max_dt:
aligned_obs[k] = None
else:
aligned_obs[k] = data[idx]
return aligned_obs
|