• 首页 > 云计算频道 > 大模型

    Mistral 推出精细调整工具,使定制化模型更加简单快捷

    2024年06月06日 14:03:09   来源:站长之家

      法国开源人工智能模型提供商 Mistral 近日推出了新的定制化功能,以降低精细调整的成本并降低进入门槛。这家公司在过去的14个月里迅速崛起,即将达到60亿美元的估值。

      精细调整对于改善大型语言模型(LLM)的输出并将其定制到特定的企业需求中至关重要。当精细调整做得正确时,可以得到更准确和有用的模型响应,使组织能够从其生成式人工智能应用程序中获得更多的价值和精确性。

      Mistral 以在开源许可下发布几个强大的 LLM 而闻名,这意味着可以自由地接受和调整这些模型,不收费用。然而,该公司也提供付费工具,如 API 和开发平台 “La Plateforme”,以便于那些希望在其模型之上进行开发的用户。通过使用 API 调用,用户可以构建自己的 Mistral 应用,而不是在自己的服务器上部署 Mistral 的版本。

      除了构建在现有模型之上,用户现在还可以在 La Plateforme 上定制 Mistral 模型,或者通过 Mistral 在 Github 上提供的开源代码在自己的基础设施上进行定制。此外,对于那些希望在自己的基础设施上工作的开发人员,Mistral 今天发布了轻量级的代码库 mistral-finetune,它基于 LoRA 范式,可以减少模型所需的可训练参数的数量。

      Mistral 在其博客文章中写道:“使用 mistral-finetune,您可以在自己的基础设施上对我们所有的开源模型进行精细调整,而无需牺牲性能或内存效率。” 同时,Mistral 还提供了适用于无服务器精细调整的新服务,利用了公司通过研发不断优化的技术。Mistral 表示,底层的 LoRA 适配器可以防止模型遗忘基本模型的知识,同时实现高效的服务。

      此外,Mistral 还提供定制培训服务,根据客户的特定应用使用专有数据对 Mistral AI 模型进行精细调整。该公司通常会提出先期持续训练等先进技术,以在模型权重中包含专有知识,从而为特定领域创建高度专业化和优化的模型。

      与今天的发布相配套,Mistral 启动了一场 AI 精细调整黑客马拉松。该比赛将持续到6月30日,让开发人员可以尝试使用该创业公司的新的精细调整 API。

      Mistral 自成立以来一直在不断加速创新,并获得大量资金支持。该公司于2023年4月由前谷歌 DeepMind 和 Meta 员工 Arthur Mensch、Guillaume Lample 和 Timothée Lacroix 创立,成立仅14个月就进行了创纪录的1.18亿美元的种子轮融资,据说是欧洲历史上最大的一笔。成立几个月后,Mistral 与 IBM 等公司建立了合作伙伴关系。今年2月,Mistral 通过与微软的合作,通过 Azure 云提供了 Mistral Large。

      文章内容仅供阅读,不构成投资建议,请谨慎对待。投资者据此操作,风险自担。

    即时

    新闻

    敢闯技术无人区 TCL实业斩获多项AWE 2024艾普兰奖

    近日,中国家电及消费电子博览会(AWE 2024)隆重开幕。全球领先的智能终端企业TCL实业携多款创新技术和新品亮相,以敢为精神勇闯技术无人区,斩获四项AWE 2024艾普兰大奖。

    企业IT

    重庆创新公积金应用,“区块链+政务服务”显成效

    “以前都要去窗口办,一套流程下来都要半个月了,现在方便多了!”打开“重庆公积金”微信小程序,按照提示流程提交相关材料,仅几秒钟,重庆市民曾某的账户就打进了21600元。

    3C消费

    “纯臻4K 视界焕新”——爱普生4K 3LCD 激光工程投影

    2024年3月12日,由爱普生举办的主题为“纯臻4K 视界焕新”新品发布会在上海盛大举行。

    研究

    2024全球开发者先锋大会即将开幕

    由世界人工智能大会组委会、上海市经信委、徐汇区政府、临港新片区管委会共同指导,由上海市人工智能行业协会联合上海人工智能实验室、上海临港经济发展(集团)有限公司、开放原子开源基金会主办的“2024全球开发者先锋大会”,将于2024年3月23日至24日举办。