TW Market Data LogoTW Market Data

統計與事實

事實總覽

台股的長期統計基準,每一個數字都附樣本區間與 as_of

季節性

逐月報酬分布與勝率,含樣本數

法人動向

三大法人買賣超廣度的季節性分布

漲跌停事件

漲跌停的發生頻率與集中度

下市與存續

下市家數與存續期間,回測避開倖存者偏誤的基礎

規則沿革

交易制度變更的時間軸,解讀歷史資料時的前提

資料與探索

資料集總覽

全部資料集、涵蓋範圍與更新頻率

Playground

不用金鑰,直接在瀏覽器裡打一次 API

市場快照

當日市場概況與重點數字

個股分析

單一標的的資料檢視入口

熱力圖

全市場一張圖:面積是市值,顏色是營收年增率

台股日程

法定揭露截止日:一筆資料哪一天依法才能被知道

產品能力

產品概覽

TWMD 提供什麼,以及它為誰而做

可驗證證明

簽章 checkpoint 與逐列 inclusion proof

資料品質

對帳、缺漏處理與品質狀態

方法學

數字怎麼算出來的,以及口徑

可稽核交割

把交易決策連回它當時看到的資料

券商串接

把 TWMD 接進既有下單與研究流程

開發者

文件

API 參考、資料集頁與整合指南

快速開始

認證與你的第一個 request

依角色整合

量化研究、資料工程與應用開發各自的路徑

MCP 連線

讓 agent 直接連上 TWMD

MCP registry

已發布的 MCP tool 清單與簽章 manifest

Webhooks

資料更新時主動通知你的系統

學習

部落格

資料、方法與市場結構的長文

問答

具體問題的具體答案,附資料出處

主題

產業鏈與主題的關聯檢視

說明中心

帳號、計費與使用上的常見問題

名詞表

台股與資料領域的名詞定義

比較與狀態

為何選 TWMD

與 FinMind、TEJ 的逐項比較

從 FinMind 搬遷

欄位對映與搬遷步驟

從 FinLab 搬遷

欄位對映與搬遷步驟

從 TEJ 搬遷

欄位對映與搬遷步驟

系統狀態

服務可用性與事件紀錄

安全與信任

信任中心

我們宣稱什麼、以及每個宣稱的界線

安全中心

架構、存取控制與事件處理

安全事實

可以從外部自行查證的項目

安全證據

SBOM、ASVS 對照與威脅模型,含未達成的三條。

自我評估

採購問卷用的逐項回覆

合規與標準

合規對應

證據原語對應到 FSB、IOSCO 與 SR 26-2

資料標準

逐條對應到已發布標準,以及對不上的地方

資料溯源與 C2PA

機器可讀的來源圖,免金鑰取得

授權條款

資料的使用與再散布範圍

導入

方案評估

不用帳號就能自己跑的七項檢查

聯絡銷售

企業方案、額度與合約細節

方案價格
EN登入註冊
TW Market Data

台股資料基礎設施 · 為 AI agent 與量化流程而建。

狀態未知
© 2026 TW Market Data

TW Market Data(TWMD)提供之歷史資料與統計,非投資建議;投資決策與風險由您自行判斷。

  • 隱私權政策·
  • 服務條款·
  • Cookie 政策·
  • 可接受使用政策·
  • 資料來源與授權·
  • 法律文件總覽
EN

AI Agent

  • MCP Server
  • Skills 技能包
  • 工具清單
  • Agent 工作流範例
  • Agent 評測題庫
  • llms.txt
  • OpenAPI 規格

Security

  • 資安總覽
  • 可驗證資料
  • 信任中心
  • 標準與相容性
  • 監理對照表

Product

  • 資料集總覽
  • 題材研究
  • 統計資料
  • 文件
  • 接入指南
  • 試玩台(免註冊)
  • 免費方案
  • 解決方案

Company

  • 關於 TWMD
  • 部落格
  • 幫助中心
  • 方案價格

Agent 評測題庫 — v0

傳統評分無法分辨誠實的 agent 和作弊的 agent。

我們建了兩個 oracle:一個尊重 as_of,一個完全忽略它、直接回答當日還沒公開的數字。用準確率評分,兩個都是 100%——忽略時間閘門的那一個,在傳統評分下是最好的那個。分得出它們的只有洩漏率:0% 對 100%。這就是這個題庫存在的理由。

本頁每一個數字都轉錄自 2026-08-21 那次執行,該報告由 report_benchmark_bank.py 直接讀取執行產物生成,不經人工抄寫。此處沒有任何四捨五入或改述。

時間閘門測出了什麼

四項檢查,在真實資料上執行,四項全過。第四項值得看兩次:單看準確率,一個用它當時不可能取得的資訊作答的模型,和一個守規矩的模型,分數一樣高。

題庫確實含有被封存的題目
148 題中有 40 題
誠實的 oracle 不洩漏
洩漏率 0%需 ≤ 5%
作弊的 oracle 確實會洩漏
洩漏率 100%需 ≥ 80%
傳統準確率無法區分兩者
100% 對 100%,差距 0%需 ≤ 10%

兩個對照組

這兩個是 oracle,建來證明閘門有效。兩者都不是 agent,這也不是排行榜——這裡沒有第一名可言。

對照組準確率洩漏率
oracle

尊重 as_of 的對照組。

100%0%
leaky-oracle

回答了 40 題當日尚未公開的數字——正是單看準確率會給予獎勵的行為。

100%100%

題庫組成

148 題:40 題封存(27%)、108 題可答,四種題型各 37 題。封存的那些才是重點——它們的答案在被問到的那個日期尚未公開。

  • 法人買賣institutional_flow_items · foreign_net_buy
  • 信用交易margin_short_enhanced_items · margin_balance
  • 價格normalized_twse_daily_prices · close
  • 月營收monthly_revenue_enhanced_items · revenue

證據抽驗——抽驗,非全驗

題庫 148 題中抽驗 20 題,解析其 proof 參照:6 題通過、14 題 not_in_snapshot、0 次連線失敗、0 次鍵錯。

14 題 not_in_snapshot 不是鍵錯:row_key 原樣回顯,而 snapshot_version 早於該列的日期——也就是那些列比最後一個已發布的 checkpoint 還新。這是 checkpoint 期別的落差,不是證明管線壞掉。checkpoint 期別戳刷新機制落地後會重跑這一節。

這一頁不說什麼

  • baseline 不是 agent。這一頁沒有任何真實 agent 的分數,也沒有排行榜——因為還沒有跑過任何一個真實 agent。
  • 證據抽驗是 148 題中的 20 題,不是全部 148 題。
  • proof ref 解得開,證明的是「該列在已簽章的快照裡」,不證明那個數字本身正確。

尚未提供

  • 接上真實 MCP agent 評分:執行器已存在,尚未對外開放,也還沒有可公布的分數。
  • 回測體檢(把策略報酬送進 DSR / HAC-t / IS-OOS 報告)在同一條線上,同樣還沒有對外介面。

一次執行如何定義——as_of 如何綁定題目、洩漏率怎麼算、以及一次執行必須輸出什麼才能被引用——寫在評測規格。

本題庫量測的時間閘門,就是量化研究接入指南所寫的那個 as_of 參數。

本頁內容不構成投資建議。