Le Chat全方面对标ChatGPT,欧洲AI新贵穷追不舍

搜索
AI-TNT
正文
资源拓展
Le Chat全方面对标ChatGPT,欧洲AI新贵穷追不舍
2025-07-18 09:14
Mistral AI只是想做欧洲版的OpenAI?


最近几个月,由谷歌和 Meta 前研究人员建立的欧洲的 AI 初创公司 Mistral AI 有些躁动不安。


他们接连发布了好些个开源模型,覆盖不同的领域,包含号称「世界上最优秀」的 OCR 模型、「对标 Claude」的多模态模型、首个推理大模型 Magistral 以及两天前发布的「全球最佳」的开源语音模型 Voxtral。


这样似乎也很难让这位欧洲 AI「新贵」感到满意,他们还想在应用层面好好地卷一卷 OpenAI。


他们将 Le Chat 再一次升级,引入了一些强大的新功能,使其更强大、更直观,也更有趣,在功能上几乎全方位对标 ChatGPT。


Le Chat全方面对标ChatGPT,欧洲AI新贵穷追不舍


Le Chat 的新功能


  • 深度研究模式:即使是复杂主题,也能快速生成结构化的研究报告。
  • 语音模式:使用我们的新 Voxtral 模型与 Le Chat 对话,而不是用键盘输入。
  • 原生多语言推理:借助我们的推理模型 ——Magistral,获取深思熟虑的答案。
  • 项目管理:将您的对话组织到内容丰富的文件夹中。
  • 高级图像编辑,在 Le Chat 中直接进行,与 Black Forest Labs 合作。


研究模式可将 Le Chat 转变为一个协调的研究助手,能够规划、明确需求、搜索和综合信息。提出一个有深度的问题,它会将其分解,收集可靠的资料,并构建一个结构清晰、有参考文献支持且易于理解的报告。


它由工具增强型深度研究 Agent 驱动,但设计得简单、透明且真正有帮助,仿佛与一个组织良好的研究伙伴合作。


Mistral AI 也在官网展示了一些用例。深度研究模式能够追踪市场趋势、撰写商业策略书、做个人计划以及最重要的、进行学术研究。


Le Chat全方面对标ChatGPT,欧洲AI新贵穷追不舍


语音模式可以像和人聊天一样与 Le Chat 交流 —— 无需打字。你可以在散步时头脑风暴、在处理杂事时快速获取答案或转录会议内容。它由 Mistral 新的语音输入模型 Voxtral 驱动,专为自然、低延迟的语音识别而构建,能跟上用户的工作速度。


但目前 Le Chat 仅支持语音转文字的输入,该功能并非实时语音对话


所以,跟电子助手聊天的功能依旧没有实现,更别提 Grok 4 Ani 那样的数字伴侣了。


图像编辑功能方面,可以通过「移除物体」或「将我放置在另一个城市」等简单提示来创建并编辑图像。模型支持转换场景,同时保留角色和细节。这有助于保证编辑的一致性:可以保持人物、物体和设计元素在图像之间的不会变得认不出来。


图像编辑这块,Le Chat 似乎做得出人意料的好。网友在论坛分享了使用体验,认为 Le Chat 做得比 OpenAI 更好。


「OpenAI 的模型在编辑时会改变整个图像,导致无关区域出现细节错误。(Le Chat)似乎完美地保留了与查询无关的图像部分,并选择性地应用编辑,这令人印象深刻!」


Le Chat全方面对标ChatGPT,欧洲AI新贵穷追不舍


网友上传了一张家庭办公室的照片,并提出了以下提示:「修复照片底部略微撕裂的灰色面板,让它们看起来像全新的」,编辑结果非常令人满意。


Le Chat全方面对标ChatGPT,欧洲AI新贵穷追不舍


Le Chat全方面对标ChatGPT,欧洲AI新贵穷追不舍


上图为原始图像,下图为编辑后图像


对于这些新功能,我们的读者想必已经非常熟悉。在这一次的大更新之后,Le Chat 在功能上基本实现了与 ChatGPT 等行业领先的产品保持一致。


最近 Mistral AI 的动作确实让人看到了欧洲在大模型领域保持追赶的势头。对此,网友们表达了对 Mistral 快速追赶的兴奋。


Le Chat全方面对标ChatGPT,欧洲AI新贵穷追不舍


Le Chat全方面对标ChatGPT,欧洲AI新贵穷追不舍


值得分享的是,Le Chat 在法语中意为「猫」,而 Mistral AI 的主页底部就有一只像素猫咪,Mistral AI 图标也形似一只猫猫头,非常可爱。


Le Chat全方面对标ChatGPT,欧洲AI新贵穷追不舍


Mistral AI 的语音识别模型


7 月 15 日,Mistral AI 发布了全新的语音识别模型 Voxtral,号称是「全球最佳(且开源)」的语音识别模型。


Le Chat全方面对标ChatGPT,欧洲AI新贵穷追不舍


Voxtral 在语音转写方面全面超越了 Whisper large-v3,当前领先的开放源代码语音转写模型。它在所有任务中都击败了 GPT-4o mini Transcribe 和 Gemini 2.5 Flash,并在英语短形式和 Mozilla Common Voice 上取得了最先进的结果,超越了 ElevenLabs Scribe,展示了其强大的多语言能力。


Le Chat全方面对标ChatGPT,欧洲AI新贵穷追不舍


Voxtral 3B 和 Voxtral 24B 模型不仅仅具备语音转录功能,还具备以下能力:


  • 超长上下文理解:支持最长 32k token 的上下文,转录最长达 30 分钟音频,理解可达 40 分钟;
  • 内置问答与摘要功能:无需将语音识别与语言模型串联,即可直接针对音频内容提问或生成结构化摘要;
  • 原生多语种支持:具备自动语言识别功能,在全球主流语言(如英语、西班牙语、法语、葡萄牙语、印地语、德语、荷兰语、意大利语等)中均达到业内领先表现,助力团队以单一系统服务全球用户;
  • 从语音直接触发函数调用:可根据用户的语音意图直接触发后端函数、工作流或 API 调用,无需中间解析步骤,实现语音到系统指令的无缝转换;
  • 强大的文本理解能力:延续其语言模型基础(Mistral Small 3.1)在文本处理方面的高性能表现。


文章来自微信公众号 “ 机器之心 ”


1
AI工作流

【开源免费】n8n是一个可以自定义工作流的AI项目,它提供了200个工作节点来帮助用户实现工作流的编排。

项目地址:https://github.com/n8n-io/n8n

在线使用:https://n8n.io/(付费)


【开源免费】DB-GPT是一个AI原生数据应用开发框架,它提供开发多模型管理(SMMF)、Text2SQL效果优化、RAG框架以及优化、Multi-Agents框架协作、AWEL(智能体工作流编排)等多种技术能力,让围绕数据库构建大模型应用更简单、更方便。

项目地址:https://github.com/eosphoros-ai/DB-GPT?tab=readme-ov-file



【开源免费】VectorVein是一个不需要任何编程基础,任何人都能用的AI工作流编辑工具。你可以将复杂的工作分解成多个步骤,并通过VectorVein固定并让AI依次完成。VectorVein是字节coze的平替产品。

项目地址:https://github.com/AndersonBY/vector-vein?tab=readme-ov-file

在线使用:https://vectorvein.ai/(付费)

2
智能体

【开源免费】AutoGPT是一个允许用户创建和运行智能体的(AI Agents)项目。用户创建的智能体能够自动执行各种任务,从而让AI有步骤的去解决实际问题。

项目地址:https://github.com/Significant-Gravitas/AutoGPT


【开源免费】MetaGPT是一个“软件开发公司”的智能体项目,只需要输入一句话的老板需求,MetaGPT即可输出用户故事 / 竞品分析 / 需求 / 数据结构 / APIs / 文件等软件开发的相关内容。MetaGPT内置了各种AI角色,包括产品经理 / 架构师 / 项目经理 / 工程师,MetaGPT提供了一个精心调配的软件公司研发全过程的SOP。

项目地址:https://github.com/geekan/MetaGPT/blob/main/docs/README_CN.md

3
语音转录

【开源免费】Whisper是由openai出品的语音转录大模型,它可以应用在会议记录,视频字幕生成,采访内容整理,语音笔记转文字等各种需要将声音转出文字等场景中。

项目地址:https://github.com/openai/whisper

在线使用:https://huggingface.co/spaces/sanchit-gandhi/whisper-jax

4
免费使用GPT-4o

【免费】ffa.chat是一个完全免费的GPT-4o镜像站点,无需魔法付费,即可无限制使用GPT-4o等多个海外模型产品。

在线使用:https://ffa.chat/

5
无人直播

【开源免费】VideoChat是一个开源数字人实时对话,该项目支持支持语音输入和实时对话,数字人形象可自定义等功能,首次对话延迟低至3s。

项目地址:https://github.com/Henry-23/VideoChat

在线体验:https://www.modelscope.cn/studios/AI-ModelScope/video_chat


【开源免费】Streamer-Sales 销冠是一个AI直播卖货大模型。该模型具备AI生成直播文案,生成数字人形象进行直播,并通过RAG技术对现有数据进行寻找后实时回答用户问题等AI直播卖货的所有功能。

项目地址:https://github.com/PeterH0323/Streamer-Sales

添加客服微信openai178,进AITNT官方交流群
IOS下载
安卓下载
微信群
沪ICP备2023015588号