镜像应用


<font face="黑体" size=4>&emsp;&emsp;算家云提供多样化的镜像资源,满足您在不同场景下的需求,您可以根据自身需求选择最合适的镜像,节省配置时间,加速应用部署。以下是算家云部分镜像的介绍:</font>

<font face="黑体" size=4>1. text-generation-webui
&emsp;&emsp;text-generation-webui 是为大规模语言模型量身打造的Gradio Web界面,全面兼容transformers框架,以及一系列高性能量化模型,包括GPTQ、AWQ、EXL2,同时还支持基于GGUF格式的llama.cpp和Llama模型。
特点:
&emsp;• 3种界面模式:default (two columns), notebook, chat
&emsp;• 支持多个模型后端:Transformers、llama.cpp(通过 llama-cpp-python)、ExLlama、ExLlamaV2、AutoGPTQ、AutoAWQ、GPTQ-for-LLaMa、CTransformers、QuIP#。
&emsp;• 下拉菜单可在不同模型之间快速切换。
&emsp;• 大量扩展(内置和您贡献),包括用于真实语音输出的 Coqui TTS、用于语音输入的 Whisper STT、翻译、多模式管道、向量数据库、Stable Diffusion集成等等。
&emsp;• 与自定义角色聊天。
&emsp;• 适用于指令跟踪模型的精确聊天模板,包括 Llama-2-chat、Alpaca、Vicuna、Mistral。
&emsp;• LoRA:使用您自己的数据训练新的 LoRA,动态加载/卸载 LoRA 以进行生成。
&emsp;• Transformers 库集成:通过 bitsandbytes 以 4 位或 8 位精度加载模型,将 llama.cpp 与 Transformers 采样器( llamacpp_HF 加载器)结合使用,使用 PyTorch 以 32 位精度进行 CPU 推理。
&emsp;• 具有 OpenAI 兼容的 Chat 和 Completions API 服务器。

2. ChatTTS
&emsp;&emsp;ChatTTS技术是一项先进的计算机程序功能,它允许计算机程序将书面文字转化为语音输出。广泛应用于多种场合,例如语音助手、电子书籍朗读、自动电话服务以及辅助技术等。您只需输入文本信息,ChatTTS系统便会运用其内部的语音合成机制,结合自然语言处理和高级语音生成引擎,将文本转换为逼真、流畅的语音,并通过扬声器实时播放或保存为音频文件,从而提供一种自然而直观的交流方式。
特点:
&emsp;• 对话式优化:ChatTTS专注于对话式任务,确保合成语音的自然性和流畅性。
&emsp;• 细粒度控制:支持对笑声、停顿和插入词等声音元素的精确操纵。
&emsp;• 多说话人支持:能够模拟不同性别和风格的说话人,增加语音的多样性。
&emsp;• 高效接口:提供简单易用的Python API,方便快速集成到现有项目中。
&emsp;• 多语言支持:支持中文和英文,适用于多语言环境并满足不同语言用户的需求。
&emsp;• 大规模数据训练:使用了大约10万小时的中文和英文数据进行训练,使得语音合成质量高,听起来自然。
&emsp;• 开源:项目是开源的,鼓励进一步的研发与创新,并提供预训练模型。
&emsp;• 易用性:只需要文本信息作为输入,就可以生成相应的语音文件,方便有语音合成需求的用户。

3. Open-Sora-Plan
&emsp;&emsp;Open-Sora-Plan凭借其卓越的性能与直观的操作界面,已成为人工智能领域不可或缺的瑰宝,为广大学者与工程师开辟了一片探索智能规划前沿的沃土。无论您身处研究的象牙塔,还是奋战在开发一线,这个平台都将会是您的理想伙伴。
特点:
&emsp;• 开源免费:遵循Apache 2.0许可协议,任何人都可以自由使用、学习和贡献代码。
&emsp;• 模块化设计:各个组件可以独立使用,方便定制和扩展。
&emsp;• 丰富的示例:项目提供多个示例,帮助新手快速上手。
&emsp;• 文档完善:详细的API文档和教程,降低学习曲线。