分类
探索 数据科学与机器学习
通过 MCP 工具使用 fal.ai 模型生成图像、视频和音频,支持文本转图像、文本/图像转视频、文本转语音以及视频转音频功能。
2026-10-01
通过 GPT Image 2 在三种模式下生成和编辑图像:通过兼容 OpenAI 的 API 直接生成、针对主机原生图像工具进行提示工程,或纯提示建议。包含 80 多个结构化模板,适用于海报、UI 原型、产品视觉设计、地图、幻灯片等。
2026-09-30
构建一个本地浏览器代理,通过 CDP Fetch 拦截强制执行域名白名单,使用 safe_browser 工具拥有 Playwright 会话并阻止域外请求。
2026-09-30
在 Megatron-Bridge 中验证和配置打包序列及长上下文训练,区分针对大型语言模型(LLMs)的离线打包 SFT 与针对具有正确上下文并行性约束的超大型语言模型(VLMs)的批量内打包。
2026-09-29
使用 NGC PyTorch 容器在本地 NVIDIA GPU 上微调 HuggingFace 的 CV、VLM 或 LLM 模型,支持全量或 LoRA 训练、数据集处理,以及可选的模型推送到 Hub。
2026-09-29
根据选定的NIM对临床ASR清单进行评分,生成包含五个部分的KER排行榜,并通过评估后决策树引导用户。
2026-09-28
为在 Megatron Bridge 中训练专家混合视觉-语言模型提供了实用指南,并结合近期多模态实验的经验,对比了 FSDP 方法与 3D 并行方法。
2026-09-28
本文为使用长上下文窗口训练“专家混合”模型提供了指导,内容涵盖上下文并行度的确定、选择性重新计算、调度器选择,以及近期实验中总结出的实用模式。
2026-09-28
通过运行一个 Docker 容器,该容器执行阈值扫描、弱样本评分和按光照条件扩展操作,从而在 NVIDIA TAO VCN Classify 实验中,针对每个真实标签识别出最弱的样本,并筛选出前 K 个弱样本,供下游增强或重新标注使用。
2026-09-28





