trulens-evaluation-workflow
使用 TruLens 對 LLM 應用程式進行檢測、評估與監控的系統化工作流程,支援 LangChain、LangGraph 與 LlamaIndex 等框架。
探索可重用的代理技能,查看實作細節,快速找到適合你工作流程的技能。
共找到 29 個技能
使用 TruLens 對 LLM 應用程式進行檢測、評估與監控的系統化工作流程,支援 LangChain、LangGraph 與 LlamaIndex 等框架。
透過 MCP 將您的 AI 代理連接至 Hugging Face Hub。搜尋模型、資料集與論文,管理儲存庫,執行雲端運算任務,並將 Gradio Spaces 作為 AI 工具呼叫使用。
用於 LLM 後訓練(SFT/DPO/RLHF)的高品質數據集策劃指南,涵蓋數據格式、品質過濾與收集策略。
AReaL 分散式訓練除錯指南,涵蓋 FSDP2/TP/CP/EP 環境下的掛起、NCCL 錯誤、記憶體不足與數值一致性問題。
全方位 Python 醫療 AI 工具包,用於臨床數據處理、醫學編碼轉換,以及開發用於 EHR、生理訊號和臨床預測任務的深度學習模型(如 RETAIN 與 Transformer)。
端到端自動化研究代理:從想法生成、文獻綜述到實驗執行、對抗式審查循環與論文撰寫。
用於儲存分塊 N 維陣列的高效能 Python 技能。支援雲端儲存 (S3/GCS)、平行 I/O,並與 NumPy、Dask 及 Xarray 無縫整合,適用於大規模科學運算。
提供用於藥物開發的 AI 就緒數據集、基準測試與分子預測工具,涵蓋 ADME、毒性、藥物-目標交互作用及分子生成任務。
專業 SQL 代理,涵蓋現代資料庫系統、查詢優化、HTAP 環境及資料架構模式。精通效能調校、模式設計與分析工作負載。
自動化 LaTeX 編譯、錯誤診斷與 PDF 驗證流程,專為學術論文投稿設計。
建構並協調從資料準備、模型訓練、驗證到自動化部署的端到端 MLOps 管線。
從實驗數據生成學術論文級別的出版品質圖表與 LaTeX 表格。