TypeSafe AIが引用チェッカーに追加
ユーザーが引用チェッカーに@typesafeaiを追加し高評価。PaperTrellisで無料試用可能。Jevと医療AIのタグ付き。 Link
Jevを架空の月面危機デモに配置し、5つの簡単なシナリオを1回の呼び出しで実行。ネットワーク時間を除くモデル評価は約91.8ms。著者は玩具実験であり信頼性ベンチマークではないと述べている。
We put Jev inside a fictional lunar crisis demo. 🌕 5 simple scenarios. One call. ~91.8 ms model evaluation, excluding network time. That is a toy experiment, not a reliability benchmark. Next test idea: missing telemetry + conflicting signals. What should the city do?