Together AI 成立于 2022 年,总部位于美国旧金山,是专注开源大模型的推理云平台,提供 200+ 模型的低延迟推理 API、LoRA 微调和 GPU 训练集群,API 完全兼容 OpenAI 格式。
服务商
4 条结果Fireworks AI 是 2022 年成立于美国加州的极速大模型推理平台,自研 FireAttention 内核把 Llama、DeepSeek 等开源模型推理延迟压至毫秒级,API 兼容 OpenAI 格式。
Stability AI 是 2020 年成立于英国伦敦的开源 AI 图像生成公司,以 Stable Diffusion 系列模型闻名,支持文生图、图生图、视频与音频生成,提供云 API 与自托管部署。
Replicate 成立于 2019 年,总部位于美国旧金山(YC 背景),是面向开源 AI 模型的云端托管平台,通过统一 API 按秒计费运行图像、视频、音频等模型,累计推理运行数千万次。
新闻资讯
3 条结果本地 LLM 部署指南:使用 Ollama 在本地运行开源大模型
使用 Ollama 在本地服务器或开发机上运行 Llama 3、Mistral、Qwen 2 等开源大模型,无需 GPU 也可运行。
怎么给业务选一个大模型:开源与闭源、参数、上下文、价格的取舍
选大模型没有"最好的"只有"最合适的"。本文从开源/闭源、参数规模、上下文长度、价格、延迟五个维度拆解取舍,并附一张可落地的选型对比表。
Hugging Face 平台与 Transformers 指南:Hub 到部署
Hugging Face 是开源 AI 的枢纽平台。本文介绍 Hub 上的模型、数据集与 Spaces,以及 Transformers 库的 Pipeline、Trainer 与推理能力,并给出从下载到部署的完整路径。