挑战OpenAI的新模型免费上线，40%计算量性能逼近GPT-4_行业动态

挑战OpenAI的新模型免费上线，40%计算量性能逼近GPT-4

发布时间：2024-03-08 15:46

发布者：网络

浏览次数：

本周四，美国 AI 创业公司 Inflection AI 正式发布新一代大语言模型 Inflection-2.5。

据介绍，Inflection-2.5将结合强大的LLM技术和Inflection独有的“同理心微调”特性，综合了高情商和高智商的特点。它可以通过联网获取事实信息，性能媲美GPT-4和Gemini等领先的大型模型。

Inflection-2.5 现已向所有 Pi 用户开放，可在 PC 端、iOS 和安卓 App 上免费使用。机器之心简单测试后发现，与GPT-4相比仍有一定差距，但仍值得一试。感兴趣的用户可以自行体验。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

链接：https://pi.ai/talk

刺鸟创客

一款专业高效稳定的AI内容创作平台

110 查看详情刺鸟创客

值得注意的是，Inflection-2.5 实现了接近 GPT-4 的性能，而训练过程却仅使用 GPT-4 40% 的算力。

Inflection AI指出，新一代大型模型在智能编码和数学等领域取得了显著进展。这些进展将转化为对关键行业基准的具体改进，从而确保Pi一直站在技术的前沿。另外，Pi还整合了世界一流的实时网络搜索功能，以确保用户能够获得高质量的突发新闻和最新资讯。

Inflection-2.5 vs GPT-4

Inflection-1 训练使用的 FLOP 约为 GPT-4 的 4%，在各种「IQ 导向」型任务中，其平均性能约为 GPT-4 水平的 72%。现在，Inflection-2.5 尽管只使用 GPT-4 40% 的 FLOP 来进行训练，但其平均性能却达到了 GPT-4 的 94% 以上。如下图所示，Inflection-2.5 的性能取得了全面的显著提升，其中 STEM 领域知识的改进最大。

挑战OpenAI的新模型免费上线，40%计算量性能逼近GPT-4

Inflection-2.5 在两项不同 STEM 考试 —— 匈牙利数学考试、物理学研究生入学考试（GRE）—— 的成绩如下：

挑战OpenAI的新模型免费上线，40%计算量性能逼近GPT-4

如下表所示，该研究还在 MMLU 基准、GPQA Diamond 基准上评估了 Inflection-2.5。MMLU 基准涵盖 STEM、人文、社会科学等领域的 57 个学科，能够有效地测试 LLM 的综合知识能力，而 GPQA Diamond 基准是一个极其困难的专家级基准。

挑战OpenAI的新模型免费上线，40%计算量性能逼近GPT-4

在 BIG-Bench-Hard 基准上，Inflection-2.5 比 Inflection-1 性能提高了 10% 以上，并且可与 GPT-4 相媲美。BIG-Bench-Hard 基准主要涵盖大型语言模型难以解决的问题。

挑战OpenAI的新模型免费上线，40%计算量性能逼近GPT-4

该研究还在 MT-Bench 基准上进行了评估。然而，研究团队意识到该基准在推理、数学和编码类别中有很大一部分（近 25%）的样本示例具有不正确的参考解决方案或前提有缺陷。因此，该研究更正了这些示例，并再次进行评估实验，结果如下表所示：

挑战OpenAI的新模型免费上线，40%计算量性能逼近GPT-4

在 GSM8k 和 MATH 基准上的评估结果表明，Inflection-2.5 在数学和编码能力方面比 Inflection-1 有显著改进：

挑战OpenAI的新模型免费上线，40%计算量性能逼近GPT-4

为了进一步测试 Inflection-2.5 的编码能力，该研究在 MBPP+ 和 HumanEval+ 两个编码基准上进行了评估实验，结果如下表所示：

挑战OpenAI的新模型免费上线，40%计算量性能逼近GPT-4

研究团队在 HellaSwag 和 ARC-C、以及各种模型常识和科学基准上评估了 Inflection-2.5。从下图结果来看，Inflection-2.5 在这些基准上实现了强劲性能。

挑战OpenAI的新模型免费上线，40%计算量性能逼近GPT-4

此外，以上所有评估都是使用现在支持 Pi 的模型完成的。但也需要注意，由于网络检索（以上基准没有使用网络检索）、few-shot 提示的结构以及其他生产方面的影响，用户体验可能略有差异。

总的来说，Inflection-2.5 保持了 Pi「走心」的特性和极高的安全标准，成为了一个更全面的有用模型。

最近一段时间，大语言模型的技术竞争进入了白热化阶段，在众多科技公司中，Mistral AI（Mistral Large）、Anthropic（Claude 3）脱颖而出，提出的新技术实现了与 GPT-4、Gemini Ultra 接近的能力。昨天出现的 Inflection-2.5，似乎也要加入第一梯队的行列。

作为硅谷明星创业公司，Inflection AI 的来头不小，它成立与 2025 年，三位联合创始人分别是原 DeepMind 联合创始人 Mustafa Suleyman、Linkedln 联合创始人 Reid Hoffman，还有前 DeepMind 首席科学家 Karen Simonyan。

挑战OpenAI的新模型免费上线，40%计算量性能逼近GPT-4

去年 6 月，Inflection AI 宣布获得 13 亿美元融资，由微软、英伟达以及 Reid Hoffman、比尔・盖茨、谷歌前 CEO 埃里克・施密特领投。目前，Inflection AI 已成为全球第四大生成式 AI 创业公司。

以上就是挑战OpenAI的新模型免费上线，40%计算量性能逼近GPT-4的详细内容，更多请关注其它相关文章！

# 模型 # ai # gemini # claude # mistral ai # follow # 所示 # 下表 # 还在 # 实现了 # 施密特 # 约为 # 开源 # 进行了 # 匈牙利 # 结构化 # 广东布艺厂网络营销推广 # 旅游营销推广手段有哪些 # 六安手机端关键词排名 # 媒体村网站建设 # 建材关键词排名报价 # 网站结构优化 url # 鞍山关键词排名专业公司 # 建筑资质营销推广怎么写 # 味动力网络营销推广方案 # 邢台营销网络推广介绍