AI 模型与 LLM 精选AI Agent技能库
AI 模型与 LLM分类下的高质量技能
机器学习模型评估与基准测试
一个技术工具,通过指标加权评估输入和确定性基准逻辑,生成一致的模型排名。
ohmytoken
一款实时 AI 支出追踪器,可将 LLM Token 消耗可视化为交互式、可自定义的像素艺术珠板。
Wavelet World Model
一个用于将时序状态数据通过离散小波变换(DWT)转化为多分辨率世界模型的高级工具。
LLM 评估器
一个自动化的 LLM-as-a-Judge 系统,用于对 Langfuse 追踪轨迹进行质量、准确性和幻觉检测评分。
RV Measure
RV Measure 是一款诊断工具,旨在量化 AI 模型中的 R_V 收缩特征和递归自观察效应。
情感评分
一个高效的实用工具,用于在 -1 到 +1 的范围内对文本的情感倾向进行评分。
AI 使用量
一个全面的监控工具,用于跟踪 Anthropic 及其他服务商的 AI 配额、Token 消耗和预估成本。
Weights & Biases (wandb)
一个用于监控、分析和比较 Weights & Biases 训练运行的综合工具,旨在优化机器学习工作流。
AetherLang V3 Claude Code 集成
一个专门的技能,支持直接通过 Claude Code 执行 AetherLang V3 特定领域 AI 工作流,以进行深度分析。
MasterSwarm AI 文档分析
MasterSwarm 是一种高性能 AI 编排技能,利用 15 个专业引擎对文档和复杂查询提供深入、多维度的分析。
面向建筑业的 LLM 数据自动化
利用自然语言和大语言模型,自动化复杂的建筑数据转换及 Python 脚本生成。
Google Colab
一个用于管理可重复的 Google Colab 笔记本、机器学习实验和数据流水线的专业级框架。
Keras
一个全面的深度学习技能,用于使用 Keras 和 TensorFlow 模式构建、训练和排除神经网络故障。
PyTorch
一套综合指南和工具集,旨在避免深度学习工作流中常见的 PyTorch 陷阱。
TensorFlow AI 优化
专门用于调试和优化 TensorFlow 代码的 AI 技能,专注于性能、显存管理和图执行。
RAG 评估
一个用于评估 RAG 流水线准确性和检索质量的诊断工具,采用 Ragas 指标。
来也 Agentic 文档处理 (ADP)
这是一款企业级 AI 技能,利用先进的视觉语言模型将非结构化文档转换为结构化 JSON 数据。
OpenRouter 使用追踪器
一个用于直接从会话日志中追踪 OpenRouter API 支出、信用余额和各模型成本明细的实用工具。
S2S 模型构建器
一个用于生成端到端 AI 预报系统和 PyTorch 架构的综合构建器,专注于次季节到季节的天气预测。
机器学习模型训练器
一个自动化的机器学习模型训练管道,处理从超参数调优到通过 API 导出模型的所有环节。