122
社区成员
发帖
与我相关
我的任务
分享| 这个作业属于哪个课程 | 班级的链接 |
|---|---|
| 这个作业要求在哪里 | 作业要求的链接 |
| 这个作业的目标 | 对两个语言模型进行对比测试 |
| 其他参考文献 | 构建之法 |
文心一言(英文名:ERNIE Bot)是百度全新一代知识增强大语言模型,文心大模型家族的新成员,能够与人对话互动、回答问题、协助创作,高效便捷地帮助人们获取信息、知识和灵感。文心一言从数万亿数据和数千亿知识中融合学习,得到预训练大模型,在此基础上采用有监督精调、人类反馈强化学习、提示等技术,具备知识增强、检索增强和对话增强的技术优势。

文心一言可以解答你的问题

文心一言可以使用AI绘画

理解和推理能力:文心一言不仅能返回相关的信息,还能理解和解释用户的查询意图,并提供相应的解释和推理。文心一言可以分析上下文,理解问题的复杂性和深层含义,从而提供更精确、更有针对性的回答。
自然语言交互:文心一言能够以自然语言的方式与用户进行交互,这意味着用户可以使用自然语言提问,而不需要使用特定的关键词或查询语句。这使得交流更加自然、直观和易于理解。
功能丰富齐全:文心一言为各行各业的工作者、学生提供了丰富的创作工具,可以快速创作如文章解读、插图、内容扩展、文章检查及优化等功能。
实时性和时效性限制:文心一言所获取的信息和知识是基于训练数据和互联网上的信息,这些信息可能不是最新的。因此,在涉及实时信息或最新发展的领域,可能无法提供最新、最准确的信息。
处理复杂和模糊问题的能力有限:对于某些复杂、模糊或涉及多个因素的问题,文心一言可能无法给出精确或满意的回答。这是因为理解和解释这类问题通常需要深入的领域知识、综合分析和推理能力。
增加训练数据和多样性:通过扩大训练数据集和提高其多样性,可以更好地理解各种情境和问题,并生成更精确和丰富的回答。这包括使用更多的领域知识、跨语言数据以及实时更新的数据。
优化算法和模型架构:不断改进算法和模型架构,可以提高性能和准确性。这包括使用更先进的自然语言处理技术和深度学习算法,以优化推理、理解和生成能力。
增强实时性和时效性:提供更及时和准确的信息,与实时数据源进行集成,以便在回答中包括最新的信息。同时,定期更新训练数据和模型,确保能够跟上时代的发展和变化。
引入用户反馈机制:通过引入用户反馈机制,从用户那里获取宝贵的意见和建议,以便不断优化回答质量和用户体验。这可以通过设置评分系统、提供反馈渠道或进行定期的用户调查来实现。
背景:高中同学 软件工程专业大三学生
原因:他没用过文心一言
需求:写文章、报告, AI辅助编程


他的评价是牛头不对马嘴,需要画一幅厦门旅游路线图却只给了文字描述,辅助编程也不如copilot
操作系统:Win11 23H2
浏览器:Chrome 123.0.6312.107(正式版本) (64 位)
发生的时间段:2024/4/13
描述: 绘画预测功能异常
可复现性: 经常发生
复现步骤: 先让他做ai绘画,之后的某些问题即使你没要求他绘画也会帮你自动绘画

成因: 先让他做ai绘画,可能之后的prompt都会被当成绘画的描述,而不是正常的问题
严重性:
系统功能:算法对上下文的理解能力
用户体验:不好 本来只想问个问题的 看来中途切换个话题 ai不能即使反应
改进意见: 增强ai对于上下文的理解能力 不要把之前的话题直接套到之后的话题中
使用体验一般 有广告 回答效果也不突出
| 类别 | 评分(满分10分) |
|---|---|
| 核心功能 | 6 |
| 界面 | 5 |
| 用户体验 | 4 |
| 综合 | 5 |
Kimi是月之暗面科技有限公司开发的人工智能助手,擅长处理中英文对话,并能够提供安全、有帮助且准确的信息。Kimi具备阅读和理解多种文件格式内容的能力,同时也能够解析网页信息,以便更好地回答用户的问题。在必要时,Kimi还能利用搜索功能来获取信息。Kimi遵循一系列规则,确保对话内容的适当性,避免涉及不当的话题。

Kimi可以帮你写代码

Kimi可以解析文件内容

Kimi可以定制常用语

背景:高中同学 人工智能专业大二学生
原因:他没玩过这种ai
需求:帮他写作业


评价是还行 只是回答的有点模糊 没有给出明确结果
操作系统:Win11 23H2
浏览器:Chrome 123.0.6312.107(正式版本) (64 位)
发生的时间段:2024/4/13
描述: 对农历的回答是错误的
可复现性: 偶尔发生,20次测试出现了3次
复现步骤: 先问今天星期几,再问是农历多少。重复多次问农历就可以触发
正确答案应该是农历三月初五

成因: 中国的农历计算方法较为复杂 AI可能是通过过往训练集推导出今天是农历几号,可能出现推导错误的情况
严重性:
系统功能:这涉及到训练集以及算法是否准确。
用户体验:很糟糕 不能放心相信AI的答案 如果我有个日程安排是农历制的 那我很可能会错过这个安排
改进意见: 要么换训练集和算法 要么联网对比多个在线农历查询网站的结果再给答案
好用,推荐。界面ui很漂亮,上下文理解能力很强,还能处理文件,nice
| 类别 | 评分(满分10分) |
|---|---|
| 核心功能 | 7 |
| 界面 | 9 |
| 用户体验 | 7 |
| 综合 | 8 |
首先要收集训练集,然后用专业卡训练模型,再开发web端功能以及开放api,在有训练模型的基础上可以在2年左右训练出来
文心一言不好用,广告多,回复慢,ui也不好看,排名垫底。
Kimi的ui设计优秀,拥有目前所有大模型中最强的上下文理解能力,能够分析文件,排名低于ChatGPT4,排名第二
代码质量和安全性:利用GPT模型进行代码审查,帮助识别潜在的代码问题和安全漏洞。这需要对模型进行适当的训练,以便它能够理解代码的语义和结构。
多语言和文化适应性:考虑到GPT模型可能在不同语言和文化背景下的表现差异,开发者应当关注模型的多语言支持和文化适应性,确保其在全球范围内的有效应用。
持续监控和评估:在软件工程实践中,持续监控GPT模型的性能和输出质量是非常重要的。通过定期评估,可以及时发现问题并进行调整,确保模型的可靠性和有效性。
1.文心一言的上下文理解能力还是存在缺陷,这涉及到大模型算法本身的缺陷,可能是为了节省成本而没有选择提高模型的上下文理解能力,而是专注于在web端投放广告获取收益。
2.Kimi的农历计算存在错误,可能是因为网上已经有提供现成的工具,Kimi直接选择做一个简单的大部分时间都能正确回答的功能,而不是完美的功能。Kimi本身也是新创公司,开发团队没有足够的人手和时间去打磨各种细节。
GPT技术及其相关应用的市场正在快速增长,成为人工智能领域的一个重要分支。根据的数据,截至2023年12月,ChatGPT拥有约1.8亿用户。这个数字不仅展示了GPT技术的直接用户基数,也反映了其市场规模的庞大。此外,ChatGPT的平均每月网站浏览量达到17亿次,这进一步证明了其市场影响力和用户基础的活跃度。
在潜在用户方面,考虑到GPT技术的多样性和应用范围,潜在市场规模可能更加庞大。GPT技术不仅可以用于聊天机器人,还可以应用于文本生成、语言翻译、内容创作等多个领域。随着技术的进步和应用场景的拓展,潜在用户群体可能会进一步增加。例如,教育和办公任务是ChatGPT最受欢迎的用途之一,这表明在这些领域中,还有大量潜在用户尚未充分利用GPT技术。
另外,根据的估算,整个ChatGPT的市场规模超过2000亿美元,这表明市场对ChatGPT及其相关技术的需求巨大,从而也暗示了潜在用户群体的庞大规模。全球有超过10亿潜在用户可使用ChatGPT,这一数字表明,尽管已经拥有1.8亿直接用户,但ChatGPT仍有巨大的市场空间去吸引更多的用户。
总的来说,GPT技术的市场规模巨大,已经拥有庞大的直接用户群体,并且随着技术的不断发展和应用的深入,潜在用户市场也具有巨大的增长潜力。
市场现有产品概览
目前市场上已经推出了众多集成了GPT技术的产品,这些产品覆盖了从消费者应用到企业服务的广泛领域。
消费者应用
企业服务
教育领域
编程辅助
产品定位、优势与劣势
优势
劣势
产品间关系与竞品态势
关系
竞品
态势
领域发展阶段
核心用户群特征
典型用户
用户群体间的关系
子产品与其他相关产品间的关系
利用产品特性构建产品生态的可能性
功能名称: 交互式知识增强助手 (Interactive Knowledge Enhancement Assistant, IKEA)
功能描述:
开发一个交互式的知识增强平台,允许用户通过深入交互实时更新和扩展知识库,从而提高内容生成和问题回答的准确性和个性化水平。
功能原因:
用户使用动机:
创新点:
NABCD分析
N (Need): 用户对于更精准、个性化的信息服务的需求。
A (Approach): 通过交互式知识增强助手,用户可以实时更新知识库并引导内容生成。
B (Benefit): 用户将获得更准确、个性化的信息和内容生成服务。
C (Cost): 开发和维护新功能的成本,以及用户可能需要支付的订阅费用。
D (Differentiation): 与其他GPT应用相比,提供实时知识更新和上下文感知的增强功能。
团队配置
发布规划
第1-2周:项目启动和规划
第3-4周:设计和原型制作
第5-8周:开发阶段
第9-12周:测试和优化
第13周:内部发布和最终测试
第14周:公开Beta测试
第15周:发布准备
第16周:正式发布