根拠ワークスペース

映像から何を記録し、何をまだ聞くべきか

専門家の発話は判断レコードに、画面上の観察と視覚モデルの出力は別の視覚根拠レイヤーに保持します。観察は具体的な質問を作れますが、意味や正しさを自動では補いません。

場面・記録・質問モデルあり

15

発話・画面原文

08

直接の視覚観察

539

視覚注釈・派生手掛かり

20

実モデル成果物

07

質問候補

0:00 / 8:04

ソース映像

【町工場】ヤスリがけのコツ Part3【Milling machine】

家内事業町工場の日々 · 8:04

0399d97

根拠のルール

発話だけが判断レコードを埋める映像の観察は次の質問を提案する

構造化レコード

熟練判断レコード

発話からのみ
01

状況

L字になっている部分をどう仕上げるか。

未音声確認
02

手がかり

面を感じながら掛ける。

未音声確認

二方向からまっすぐ掛けると、角のところがきれいに掛からない。

未音声確認
03

判断基準

角のところまでヤスリが掛かっている。

未音声確認

角に掛け残しがない。

未音声確認
04

動作

45度で当てて掛ける。

未音声確認

掛け残しがないように掛け、二つの面をつなげる。

未音声確認

ヤスリになっていない側を隣の面に当てて掛ける。

未音声確認
05

理由

ヤスリになっていない側を当てると、隣の側を傷つけず、掛けたい側だけを削れるため。

未音声確認
06

例外

発話では確認できていません

02 · MULTIMODAL EVIDENCE

視覚根拠と機械観察

映像から文字通り観察できること、著者が置いた注目位置、OpenCVで派生した動き、実行済みモデルの成果物を分離して表示します。これらは専門家の意図・理由・合否判定ではありません。

Vision Lab でオーバーレイを確認
8直接の視覚観察
539視覚注釈・派生手掛かり
20実モデル成果物

観察とモデル出力は「何が見えるか」を支えます。「それが何を意味するか」は、専門家または出所つきの既存知識で確認します。

01

映像からの直接観察

画面上で確認できる対象、向き、接触候補、移動だけを記述します。

02

時刻つき視覚注釈・派生手掛かり

注目点、動き軌跡、手ランドマークなど。カードから対応場面を再生できます。

03

実行済み視覚モデルの成果物

semantic localizationgpt-5.6-sol

OpenAI · recorded-run

observations.json
hand poseMediaPipe Hand Landmarker

Google · mediapipe-0.10.35:fbc2a30080c3

hand-clip-01.json
segmentationSAM 2.1 Hiera Tiny

Meta · facebookresearch/sam2@2b90b9f5ceec907a1c18123530e92e794ad901a4

keyframes.jsoncurve-file-mask.pngcurve-support-glove-mask.pngcurve-workpiece-mask.pngl-angle-file-mask.pngl-angle-support-glove-mask.pngl-angle-workpiece-mask.pngstraight-file-mask.pngstraight-support-glove-mask.pngstraight-workpiece-mask.pngtool-show-glove-mask.pngtool-show-hand-tool-mask.pngtool-show-workpiece-mask.png
segmentationSAM 2.1 Hiera Tiny video predictor

Meta · facebookresearch/sam2@2b90b9f5ceec907a1c18123530e92e794ad901a4

262000-268000-4fps.json262000-272000-4fps.json376000-394000-4fps.json416000-426000-4fps.json84000-94000-4fps.json

同じ映像で続ける

一つのソース、五つのつながったビュー

映像を切り替えても、ガイド・分析・技能モデル・根拠・確認は同じソースハッシュを参照します。