python query方法_Pandas dataframe.query方法语法
问题:
我想更好地理解PandasDataFrame.query方法以及下面的表达式表示什么:match = dfDays.query(index > @x.name & price >= @x.target)
@x.name代表什么?
我理解这段代码(一个包含pandas.tslib.Timestamp数据的新列)的结果输出是什么,但不清楚用于获取此最终结果的表达式。
数据:
从这里开始:np.random.seed(seed=1)
rng = pd.date_range(1/1/2000, 2000-07-31,freq=D)
weeks = np.random.uniform(low=1.03, high=3, size=(len(rng),))
ts2 = pd.Series(weeks
,index=rng)
dfDays = pd.DataFrame({price:ts2})
dfWeeks = dfDays.resample(1W-Mon).first()
dfWeeks[target] = (dfWeeks[price] + .5).round(2)
def find_match(x):
match = dfDays.query(index > @x.name & price >= @x.target)
if not match.empty:
return match.index[0]
dfWeeks.assign(target_hit=dfWeeks.apply(find_match, 1))
问题: 我想更好地理解PandasDataFrame.query方法以及下面的表达式表示什么:match = dfDays.query(index > @x.name & price >= @x.target) @x.name代表什么? 我理解这段代码(一个包含pandas.tslib.Timestamp数据的新列)的结果输出是什么,但不清楚用于获取此最终结果的表达式。 数据: 从这里开始:np.random.seed(seed=1) rng = pd.date_range(1/1/2000, 2000-07-31,freq=D) weeks = np.random.uniform(low=1.03, high=3, size=(len(rng),)) ts2 = pd.Series(weeks ,index=rng) dfDays = pd.DataFrame({price:ts2}) dfWeeks = dfDays.resample(1W-Mon).first() dfWeeks[target] = (dfWeeks[price] + .5).round(2) def find_match(x): match = dfDays.query(index > @x.name & price >= @x.target) if not match.empty: return match.index[0] dfWeeks.assign(target_hit=dfWeeks.apply(find_match, 1))