软件工程实践——软件评测作业

222100304林雅婷 2024-04-16 22:20:02
这个作业属于哪个课程2302软件工程
这个作业要求在哪里软件工程实践——软件评测作业
这个作业的目标调研,评测,分析,建议和规划
其他参考文献《构建之法》

@

目录

  • 第一部分 调研,评测
  • (一)kimi
  • 1.使用体验
  • 1.1 软件介绍
  • 1.2 使用软件、优缺点分析及改进建议
  • 1.2.1 未登录页面
  • 1.2.2 登录后页面
  • 1.2.3 基本对话
  • 1.2.4 问答测试
  • 1.2.5 添加常用语
  • 1.2.6 联网功能
  • 1.2.7 上传文件
  • 1.3 采访用户
  • 2.BUG描述
  • 2.1 BUG量化指标
  • 2.2 BUG环境
  • 2.3 BUG详情
  • 2.3.1 展开资源后文字冗余
  • 2.3.2 回复错误
  • 2.3.3 文件解析失败
  • 3.总结
  • (二)讯飞星火
  • 1.使用体验
  • 1.1 介绍和使用软件
  • 1.2 优缺点分析及改进建议
  • 1.2.1 未登录页面
  • 1.2.2 主页
  • 1.2.3 基本对话
  • 1.2.4 问答测试
  • 1.2.5 星火助手
  • 1.2.6 插件
  • 1.3 采访用户
  • 2.BUG描述
  • 2.1 BUG量化指标
  • 2.2 BUG环境
  • 2.3 BUG详情
  • 2.3.1 回复错误
  • 2.3.2 某些助手功能缺陷
  • 3.总结
  • 第二部分 分析
  • (一)开发时间估计
  • 1. kimi
  • 2. 讯飞星火
  • (二)同类产品对比排名
  • 1. kimi
  • 2.讯飞星火
  • (三)软件工程方面的建议
  • 1. kimi
  • 2. 讯飞星火
  • (四)BUG存在的原因分析
  • 1. kimi
  • 2. 讯飞星火
  • 第三部分 建议和规划
  • (一)市场概况
  • 1. 市场大小
  • 2. 直接用户
  • 3. 潜在用户
  • (二)市场现状
  • 1. 市场上已有的产品
  • 2. 两款产品的定位、优势与劣势
  • 3. 两款产品之间的关系与竞争态势。
  • 4. 领域所处阶段
  • (三)市场与产品生态
  • 1.核心用户
  • 2.用户群体之间的关系
  • (四)产品规划
  • 1. 新功能描述
  • 2. 配置角色
  • 3. 十六周规划


第一部分 调研,评测

(一)kimi

1.使用体验

1.1 软件介绍

Kimi是由月之暗面科技有限公司开发的人工智能助手,旨在为用户提供高效、智能的服务体验。Kimi擅长处理中文和英文的对话,能够阅读和理解多种格式的文件,如TXT、PDF、Word文档、PPT幻灯片和Excel电子表格等。Kimi的核心能力包括:文件阅读与理解、互联网访问、多语言对话、信息检索。

1.2 使用软件、优缺点分析及改进建议

1.2.1 未登录页面
  1. 详情:
    进入网站后还未进行登录时,无法使用各功能,点击页面各交互按钮都会跳出登录页面。

    未登录

  2. 优点:
  • 不仅是右上角的登录按钮,点击各交互按钮都可以自动跳出登录页面,方便用户登录。
  1. 缺点:
  • 我认为在未登录的情况下不能发送问题提问这是较合理的,但是所有的功能都不能使用可能会使第一次使用的用户不想花时间进行功能的了解、失去耐心,从而转向其他功能类似的产品,造成不必要的用户流失
  1. 改进建议:
  • 我注意到在为这个页面中间发送问题框下面是一些“超长文本的例子”,这应该是一些指令模板。对于这类模板可以设计成在用户未登录情况下依旧可以发送并收到正确回答。这样就可以让用户能够快速了解产品功能,吸引用户兴趣。
1.2.2 登录后页面
  1. 详情:
    与未登录界面相比,登录后界面左上角增加了“历史对话”按钮可以滑动查看历史对话,右上角个人信息部分也有相应变化,可以更换深/浅模式、进行用户反馈。

    登录后

  2. 优点:
  • 页面中心logo下slogon的跳动显示具有良好的互动效果。
  • 支持深/浅模式切换,可以更好满足不同用户的审美需求以及习惯。
  • 历史会话部分按时间先后排序,页面简洁,结构清晰。
  • 支持根据会话内容在离开会话时将未命名的会话自动命名,方便用户离开会话后能够在历史会话中快速定位到该会话。

    自动命名

  1. 缺点:
  • 模式仅能选择深/浅模式,可能无法满足全部用户的需求。
  • 会话的自动命名只进行一次,即只根据第一次问答的内容进行命名,当用户接着在这个会话提问了与之前毫不相关的问题时,此时会话名与内容显然对应不上。
  • 历史会话仅能根据时间罗列所有会话,当会话数量过多时,用户想找到较早之前的会话较为困难。
  1. 改进建议:
  • 可以推出更多主题模式供用户选择。
  • 在用户对会话命名前,根据最新的用户问题重复对会话进行自动命名。而在用户对会话命名后则不再对该会话自动命名。
  • 历史会话部分新增一个搜索功能,可根据会话内容关键字搜索之前的会话。
1.2.3 基本对话
  1. 详情:
    这是一个基本会话页面,输入你的问题后按回车或发送按钮(输入框右侧的飞机图标)后可得到Kimi的回复,并且回复完成后Kimi会提供一些相关的问题。

    基本对话1


    点击会话下拉框有“修改名称”、“分享”、“删除”功能,可以对每一条问答进行“复制”、“再试一次”、“分享”、“点赞”、“点踩”操作。

    在这里插入图片描述


    会话下拉框的“分享”与回答的“分享”并不完全算是重复功能,前者会自动选中本次会话所有问答,而后者仅会选中当次问答内容,两者用户都可根据需求全选、选中或取消勾选某条信息。
    分享可以通过链接分享(点击链接可以进入到当前会话查看与继续对话)、文本复制分享图片分享(支持预览)

    分享

  2. 优点:
  • 对话功能响应较快,回复后的相关问题推荐十分给力,若推荐正确能够大大方便用户。
  • 分享功能设计合理,能够很好满足用户需求,给用户好的体验。
  1. 缺点:
  • “再试一次”功能对于某些问题并没有不同的回答,而是抹除原来的回答后将一模一样的回答再次输出,浪费用户时间。

    再试一次

  • “点赞”与“点踩”功能作用不明显,用户并不知道按下这两个按钮之后有什么效应。
  1. 改进建议:
  • “再试一次”功能对问题若没有不同的回复,则不再次输出回复而是通过弹窗等组件提醒用户“抱歉,我没有其他答案”之类的消息。
  • “点赞”与“点踩”处理点击之后图标变蓝外,相应增加弹窗等组件提醒“收到!这是一条有价值的回复,之后会增加该类型回复的使用。”/“收到!这是一条低价值的回复,之后会减少该类型回复的使用。”来增加用户交互
1.2.4 问答测试

在这部分进行几个问答测试,检验kimi的语言理解能力与知识丰富性。

  1. 语义理解:得到的结果较为准确,且分点回答,结构清晰

    在这里插入图片描述

  2. 情感分析:分析了句子的拟人手法,回答正确。

    在这里插入图片描述

  3. 逻辑推理:结果错误(正确答案:刘刚妹妹小红,马辉妹妹小英,李强妹妹小丽)。

    在这里插入图片描述

  4. 金融专业问题:回答正确。

    在这里插入图片描述

  5. 理工专业问题:回答正确且内容完善。

    在这里插入图片描述

1.2.5 添加常用语
  1. 详情:
    用户可以根据自己的需求和习惯,定制一套适合自己的常用语。在与Kimi的对话中,用户可以通过简单的触发词或者指令来快速调用预设的常用语,无需再次手动输入完整的句子。

    常用语


    示例:我经常向Kimi提问福州名探的天气,那么我可以将“”明天福州天气如何设为常用语,为添加关键词为“天气”,这样之后我想提问时只需要输入“天气”,Kimi就会自动展开为预设的完整语句。

    设置常用语


    触发常用语


    除了可以自定义常用语,Kimi也提供了随机的常用语,包含了一些常用的场景。

    随机常用语

  2. 优点:
  • 根据个人习惯定制Kimi的常用语是一个简单且个性化的过程,可以减轻用户的记忆负担,让用户与Kimi的交流更加高效和便捷。
  • 个人很喜欢的一个小设计:在设置常用语后,Kimi会根据常用语内容自动生成一个常用语图标,如上例“天气”常用语的太阳图标。不仅在美观方面起到了一定作用,在常用语逐渐多起来之后,这个小设计将帮助用户快速理清现有的常用语。
  • 随机常用语可以缓解用户的交流疲劳,增加用户与Kimi互动的乐趣,另外也为用户如何定制常用语提供了很好的范本。
  1. 缺点:
  • 以下图为例,Kimi的随机常用语中有“影视推荐”,用户想定义一个类似的常用语却不小心把它刷过了之后只能自己定义(用户一般很难写出Kimi提供的随机常用语那样详细的指令)或者再点击“换一个”按钮直到出现刚才的“影视推荐”,这样就给用户带来了不好的体验。

    常用语缺点

4.改进建议:

  • 增加提供的常用语并增加常用语搜索功能,还可以再用户定义常用语的时候分析并弹出相关的定义好的常用语供用户选择。
1.2.6 联网功能
  1. 详情:
    联网功能使得Kimi能够即时搜索互联网上的信息,为用户提供最新的数据和答案。

    联网


    进行网络搜索的时候,会有搜索的步骤动态交互展示,搜索完成,输出内容时折叠展示,可展开查看。

    联网

  2. 优点:
  • 通过连接到互联网,Kimi可以访问大量的在线知识库和数据库,为用户提供更全面、更深入、更实时的答案和解释。Kimi可以根据网络上的最新信息和数据进行自我更新,保持信息的时效性和准确性
  • 搜索时动态的交互展示让用户明确感知到系统正在响应需求,并且进行了相应的动作,减少了用户等待的焦虑。
  • 网上资源用户需要时可展开,展示结构清晰。
  • 从网络上获取的相关资料带超链接,方便用户进行深度的研究和分析。
  1. 缺点:无
  2. 改进建议:无
1.2.7 上传文件
  1. 详情:
    用户可以上传TXT、PDF、Word文档、PPT幻灯片和Excel电子表格等格式的文件,Kimi能够阅读这些文件内容并根据内容回答用户的问题。

    pdf文件解析


    我们可以发现,在上传文件后,kimi会自动关闭联网功能,鼠标移到该、联网功能图标上时,kimi给出了简短的解释“上传文件或网址后,已自动关闭联网模式”。

    在这里插入图片描述


    对于这个解释,我并不满意,因此我向kimi提问了这个问题以得到详细解释。kimi的回答是为了保护用户隐私和数据安全。

    在这里插入图片描述


    接着我又试着上传更多文件,当文件内容过多时,将不能发送这些文件跟kimi进行问答,kimi会提示“kimi只能阅读全部文件的*%,请删减后发送”,当慢慢删减文件数量时,kimi会实时计算出可阅读全部文件的百分比,直至这个百分比达到100%,这时就可以发送此时的全部文件进行问答了。

    文件过多


    我一共上传了18个文件,其中有两个文件没有按章节顺序,有一个文件重复上传了两次。

    在这里插入图片描述


    这是kimi对上面上传文件给出的核心内容整理。

    在这里插入图片描述

  2. 优点:
  • kimi能够准确读取文件内容并且响应时间快
  • 归纳能力强,能很好地归纳出内容要点,并且给出的回复结构简洁清晰,便于用户查看与理解。
  • 对于重复的文件,kimi会智能地省略重复的文件内容回复,使回复内容更加简洁清晰。
  1. 缺点:
  • kimi虽然理解了每个文件的内容,但是回复时没有根据文件内容排序,而是根据用户上传文件的顺序。我认为这较不合理,有这么一个场景:当用户向kimi提供了几个打乱的小说章节的文件,kimi没办法根据文件内容给出阅读顺序,而需要用户一个个看文件的概要内容来自己判断阅读顺序。以上只是一个简单的例子,更有一些工作或学习上的场景需要这项功能。
  • 注意到我上传了18个文件,而kimi只给出了16个文件的内容要点归纳,除去一个重复的文件,kimi漏掉了一个文件的解读。
  • kimi对重复文件的要点归纳只回复一次也存在一点小缺陷,用户可能一时无法意识到是由于自己上传了重复的文件导致kimi给出的回复跟自己上传的文件数量不一致,而得一个个查找kimi漏掉了哪个文件,浪费时间。
  1. 改进建议:
  • kimi在回复时能够智能地根据文件内容给出排好序的回复结构。
  • kimi在折叠了重复文件的回复时,在回复最后一行提醒用户“识别到您上传了*个重复的文件(具体文件名),回复中已折叠”。

1.3 采访用户

  • 采访对象:福大22级软件工程学生
  • ta的需求:通过AI问答解决学习上的问题,使用AI工具方便一些办公
  • 采访记录:

    在这里插入图片描述


    在这里插入图片描述

2.BUG描述

2.1 BUG量化指标

等级描述量化标准影响范围用户体验
★★★★★致命性问题- 系统完全崩溃
- 严重的安全性漏洞
- 无法恢复的数据丢失
整个系统完全无法使用
★★★★严重问题- 重要功能失效
- 服务器鉴权漏洞
- 重要数据泄露
系统的关键部分较差,无法完成关键任务
★★★中等问题- 次要功能失效
- 部分数据丢失或错误
- 轻微的安全性问题
系统的某些部分一般,部分功能受限
★★小问题- 用户界面的小问题
- 偶尔的性能下降
- 非关键数据的错误
个别功能基本无影响,小的不便
建议性问题- 改进建议
- 性能优化
- 用户体验提升
非功能性无影响,但有提升空间

2.2 BUG环境

  • Windows版本:Windows 11 家庭中文版
  • 操作系统版本:22000.2538
  • 浏览器:联想浏览器
  • 浏览器版本:9.0.3.1311(正式版本) (64 位)

    2.3 BUG详情

    2.3.1 展开资源后文字冗余
    • 具体情况描述
      在使用了联网功能找到问题相关资料时,用户点击展开网上资源后,最下方有一行“找到了*篇资料作为参考:”显然不应该出现在这里。

      在这里插入图片描述

    • 可复现性: 必然发生
    • 可能原因:UI设计可能存在缺陷,导致在展示搜索结果时未能正确处理或隐藏与设计不符的元素。这可能是由于前端开发中的编码错误或者布局问题。
    • 严重性:★
    • 改进建议:对相关的前端代码进行审查和测试,以发现并修复可能导致问题的代码。
    2.3.2 回复错误
    • 具体情况描述
      在使用文件上传功能之前,我询问了kimi相关问题,并没有得到正确的回答。

      上传文件描述出错

    • 可复现性:必然发生
    • 可能原因:Kimi可能经过了更新或改进,但相关功能的描述没有及时同步更新,导致提供的信息与当前功能状态不一致。
    • 严重性:★★
    • 改进建议:定期检查和更新Kimi的描述和文档,确保信息的准确性和时效性。
2.3.3 文件解析失败
  • 具体情况描述
    对于某些文件,kimi可能出现解析失败的情况,但还是能够正常查看文件。

    在这里插入图片描述


    一开始我以为是文件过大的原因,但我试着上传了更大的文件,发现kimi能够成功解析。

    在这里插入图片描述


    在这里插入图片描述


    不过文件较大,kimi需要开启一个新会话,并且无法解析文件全部内容(超出kimi字数限制,kimi能够处理的最大文本输入为20万字)。

    在这里插入图片描述

  • 可复现性
    对于某些文件必然发生
  • 可能原因
    这是kimi对不能解析某些文件原因的回复。

    在这里插入图片描述

  • 严重性:★★★★
  • 改进建议
  • 一些文件可能包含复杂的结构,如嵌套表格、多层次的目录结构或复杂的图表,增强对这些复杂文件结构的处理算法。
  • 用户不知道为什么kimi会解析失败,对此建议kimi在解析失败时给出相应的解析失败的原因以便用户能够就原因进行调整。

3.总结

定性结论:d) 好,不错
定量结论
参考现代软件工程 团队作业 - 软件分析和用户需求调查 (2013 - 2014)
设计下面的软件评价得分表,得分80-100:非常好。50-79:良好。30-49:一般。0-29:差。

评分维度描述评分标准得分
核心功能(20)分析AI大模型软件的三个核心功能,包括功能设计和质量。- 功能的实现程度
- 功能的创新性
- 功能的稳定性和可靠性
15
用户细节(10)评估AI软件是否提供了为用户考虑的细节。- 用户个性化选项
- 易用性设计
- 辅助功能和工具
8
用户体验(10)评估用户在使用AI软件时的整体体验。- 界面设计和交互
- 无干扰操作
- 用户反馈处理
8
辅助功能(10)评估AI软件提供的辅助功能,如皮肤、主题等。- 功能多样性
- 定制化程度
- 用户满意度
7
差异化功能(20)评估AI软件独特的功能及其对用户的吸引力。- 功能的独有性
- 功能的实际价值
- 用户的接受度
18
适应性(10)评估AI软件在不同环境下的适应性和兼容性。- 跨平台兼容性
- 网络环境适应性
- 设备适配性
7
成长性(10)评估AI软件是否能够根据用户行为进行学习和适应。- 用户习惯记忆
- 自我优化能力
- 个性化推荐
5
自选评分项目(10)社会影响- 推动行业的发展9
总分(100)————77

(二)讯飞星火

1.使用体验

1.1 介绍和使用软件

讯飞星火认知大模型,是科大讯飞研发的以中文为核心的新一代认知智能大模型,能够在与人自然的对话互动的过程中,同时提供以下多种能力:内容生成能力、语言理解能力、知识问答能力、推理能力、多题型步骤级数学能力、代码理解与生成能力。讯飞星火大模型可以对多元能力实现融合统一,对真实场景下的需求,具备提出问题、规划问题、解决问题的闭环能力。

1.2 优缺点分析及改进建议

1.2.1 未登录页面
  1. 详情:
    页面中间上部是招呼与语与简短的简介,中部是一些讯飞星火助手(可在未登录情况下点击),下部是提问输入框。

    在这里插入图片描述

  2. 优点:
  • 整个页面配色柔和,符合大部分人审美。排版合理,结构清晰。
  • 在未登录情况下用户可点击一些讯飞星火助手,虽然只是简单的给出一个该助手的使用示例,但能够有效让用户快速了解讯飞星火的功能。
  1. 缺点:无
  2. 改进建议:无
1.2.2 主页
  1. 详情:
    登录后页面与未登录页面相比多了下图框里的元素

    在这里插入图片描述


    在这里插入图片描述

  2. 优点:
  • 页面中心的“为您推荐”以及输入框上方的一排“插件”占据了页面主体部分,用户能够快速上手使用讯飞星火的各种功能。
  1. 缺点:
  • 界面较为杂糅,有种眼花缭乱的感觉,对想要深入了解讯飞星火的用户比如有测评作业的我不是很友好,需要花费时间边使用使用边摸索着了解。比如“为您推荐”部分其实是推荐一些助手,而左侧部分已经明确了“助手中心”这一功能。另外,在头像旁的下拉菜单里的功能不太容易被用户发现。
  • 输入框上面的插件栏不支持左右滑动查看,对习惯使用触控板的用户不太友好。

    在这里插入图片描述

  1. 改进建议:
  • 进一步规划页面分区,适当减少“为您推荐”部分页面占比,将下拉菜单的“发音人”,“Q&A指南”,“指令推荐”分离出来,可在左侧增加相应功能(个人认为这三个功能还是蛮重要的)。
  • 输入框上面的插件栏增加左右滑动查看功能。
1.2.3 基本对话
  1. 详情:讯飞星火支持文本输入、语音输入、图片输入

    在这里插入图片描述


    在这里插入图片描述


    输入“/”可获取指令模板,可在模板基础上修改

    在这里插入图片描述


    另外还具有指令优化功能

    在这里插入图片描述

  2. 优点:
  • 多种输入方式可以满足不同用户的需求,提高输入效率和便利性。
  • 通过输入“/”获取指令模板,可以帮助用户快速了解和使用各种指令,提高操作效率。
  • 用户可以在模板基础上进行修改,使其更符合自己的需求,提高个性化体验。
  • 可以对已输入的指令进行优化,提高指令的准确性和执行效率。
  1. 缺点:
  • 虽然讯飞星火支持语音输入,但语音识别的准确性可能会受到环境、发音等因素的影响,导致识别错误。
  • 图片输入可能受到图片质量、分辨率等因素的影响,导致识别效果不佳。
  1. 改进建议:
  • 提高语音识别准确性,并增加语音输入的反馈机制,让用户在识别错误时能够快速纠正。
  • 使用更高级的图像处理和分析算法,以提高对不同质量和分辨率图片的识别能力。
1.2.4 问答测试

在这部分进行几个问答测试,检验kimi的语言理解能力与知识丰富性。

  1. 语义理解:没有很好地理解,结果不准确

    在这里插入图片描述

  2. 情感分析:回答正确且提炼。

    在这里插入图片描述

  3. 逻辑推理:结果错误(正确答案:刘刚妹妹小红,马辉妹妹小英,李强妹妹小丽)。

    在这里插入图片描述

  4. 金融专业问题:回答正确。

    在这里插入图片描述

  5. 理工专业问题:回答正确,但与kimi的回答相比参考价值不高。

    在这里插入图片描述

1.2.5 星火助手
  1. 详情:
    用户可以直接由“为你推荐”选择适合的助手进行问答

    在这里插入图片描述


    也可以从助手中心里查找想要的助手

    在这里插入图片描述

  2. 优点:
  • 助手非常多,功能丰富。
  • 在会话里由“为您推荐”直接使用助手十分方便。
  • 点击“助手中心”时,“历史对话”列表会自动切换到“助手列表”,方便用户查看已使用过的助手。
  • 助手中心里的助手非常多,讯飞星火很好地解决了如何组织这些助手的问题,有“首页”、“分类”、“我的”三种范围,还有搜索功能,可以帮助用户快速找到想要的助手。
    每个助手都会有一个“热度”,可以方便用户选择大众筛选出来的相对好用的助手。
  1. 缺点:
  • 我在助手中心收藏了几个计算机软件相关的助手后刷新发现“为你推荐”部分并没有变化,我又换了个账号发现“为你推荐”部分推荐的助手是一样的,说明讯飞星火并没有根据用户的使用习惯、兴趣偏好和任务需求等因素进行个性化推荐。
  • 虽然有热度值,但在同类型助手里,助手的排列并没有按热度进行,用户若有需要需自己挑选最热助手。

    在这里插入图片描述

  1. 改进建议:
  • 进一步优化“为你推荐”部分的算法,实现根据用户的使用习惯、兴趣偏好和任务需求等因素进行个性化推荐。
  • 在同类型助手里,助手的排列按热度进行。
1.2.6 插件
  1. 详情:
    讯飞星火插件集成了讯飞及合作伙伴的多项人工智能技术,具备强大的智能化能力。目前上线的优质插件包括PPT生成、简历生成和文档问答等插件,满足用户在不同场景下的需求。
    以使用“智能PPT生成”插件为例,未勾选插件下的回复如下

    在这里插入图片描述


    勾选插件后的回复如下,可以看出讯飞星火先是创建了PPT大纲,并且支持修改,当觉得大纲没问题后可以直接“一键生成PPT”

    在这里插入图片描述


    用户可以选择想要的配色,等待一会便可生成成功并自动跳转到生成的PPT。

    在这里插入图片描述

  2. 优点:
  • 讯飞星火大模型插件集合了众多实用功能,为用户提供了一站式的办公解决方案,使工作更加高效便捷。
  1. 缺点:
  • 会话使用了某个插件之后便只能一直使用该插件,既不能取消也不能换其他插件。这是如果用户想使用其他插件必须开启一个新会话。并且必须在初始会话就选择插件,若进行了对话,则插件选择栏就会消失。

    在这里插入图片描述


    在这里插入图片描述


    在这里插入图片描述

  • 我还使用了“文档问答”插件,该插件与kimi“上传文件”功能类似,但只支持单文件上传。回答内容没有很好概括文件,也没有清晰的分点回答。因此可以看出有些插件功能并不是非常完善。

    在这里插入图片描述


    在这里插入图片描述

  1. 改进建议:
  • 考察分析并进一步修改插件栏的出现时机。
  • 进一步完善各插件功能,为用户带来更好体验。

1.3 采访用户

  • 采访对象:福大22级软件工程学生
  • ta的需求:通过AI问答解决学习上的问题,使用AI工具方便一些办公
  • 采访记录:

    在这里插入图片描述

2.BUG描述

2.1 BUG量化指标

等级描述量化标准影响范围用户体验
★★★★★致命性问题- 系统完全崩溃
- 严重的安全性漏洞
- 无法恢复的数据丢失
整个系统完全无法使用
★★★★严重问题- 重要功能失效
- 服务器鉴权漏洞
- 重要数据泄露
系统的关键部分较差,无法完成关键任务
★★★中等问题- 次要功能失效
- 部分数据丢失或错误
- 轻微的安全性问题
系统的某些部分一般,部分功能受限
★★小问题- 用户界面的小问题
- 偶尔的性能下降
- 非关键数据的错误
个别功能基本无影响,小的不便
建议性问题- 改进建议
- 性能优化
- 用户体验提升
非功能性无影响,但有提升空间

2.2 BUG环境

  • Windows版本:Windows 11 家庭中文版
  • 操作系统版本:22000.2538
  • 浏览器:联想浏览器
  • 浏览器版本:9.0.3.1311(正式版本) (64 位)

    2.3 BUG详情

2.3.1 回复错误
  • 具体情况描述:在提问了金融专业问题后又在同一个会话提问了理工专业的问题,讯飞星火没有给出正确回答,而仍旧回复金融专业问题的答案。并且点击“重新回答”也无济于事!

    在这里插入图片描述

  • 可复现性:必然发生
  • 可能原因:模型可能错误地识别了我的意图,将其归类为与前一个问题相关的跟进问题,而不是一个全新的问题。
  • 严重性:★★★
  • 改进建议:通过更好的用户意图识别技术,区分新问题和对旧问题的跟进,从而提供恰当的回答。
2.3.2 某些助手功能缺陷
  • 具体情况描述:在助手中心里随机找了一个热度较小(2.1w)的助手——英语提问老师,发现其并不能正常使用。可以看出我并没有输入任何字符,而是它自己在自言自语,并且这个助手只有两种回复...

    在这里插入图片描述

  • 可复现性:必然发生
  • 可能原因:1.这个助手可能处于Beta测试阶段,已经通过了初步的内部测试,但还需要在真实用户环境中进行进一步的测试和验证。2.可能存在审核流程中的疏漏或者对测试阶段助手的定义和要求不够明确,导致一些功能在未完全准备好的情况下就被审核通过。
  • 严重性:★★
  • 改进建议:1.制定更为严格的审核标准和流程,确保每个助手在对外开放前都经过详尽的功能和安全测试。2.对于测试阶段的助手,应当在明显位置告知用户其测试状态,使用户有充分的知情权。

3.总结

定性结论:d) 好,不错
定量结论

软件评价得分表
评分维度描述评分标准得分
核心功能(20)分析AI大模型软件的三个核心功能,包括功能设计和质量。- 功能的实现程度
- 功能的创新性
- 功能的稳定性和可靠性
16
用户细节(10)评估AI软件是否提供了为用户考虑的细节。- 用户个性化选项
- 易用性设计
- 辅助功能和工具
8
用户体验(10)评估用户在使用AI软件时的整体体验。- 界面设计和交互
- 无干扰操作
- 用户反馈处理
7
辅助功能(10)评估AI软件提供的辅助功能,如皮肤、主题等。- 功能多样性
- 定制化程度
- 用户满意度
7
差异化功能(20)评估AI软件独特的功能及其对用户的吸引力。- 功能的独有性
- 功能的实际价值
- 用户的接受度
15
适应性(10)评估AI软件在不同环境下的适应性和兼容性。- 跨平台兼容性
- 网络环境适应性
- 设备适配性
7
成长性(10)评估AI软件是否能够根据用户行为进行学习和适应。- 用户习惯记忆
- 自我优化能力
- 个性化推荐
6
自选评分项目(10)社会影响- 推动行业的发展7
总分(100)————73

第二部分 分析

(一)开发时间估计

在使用了kimi和讯飞星火的全部功能之后,我估计的基于一个由6名计算机专业大学毕业生组成的团队,并有专业的UI支持开发到这种程度的大致时间估计如下:

1. kimi

从项目启动到发布,可能需要大约5-7个月的时间。

  • 需求分析和规划(2-3week)
  • 技术分析和原型设计(3-4week)
    开发和测试(12-16week)
    测试和迭代(4-6week)
    部署和发布(1-2week)

2. 讯飞星火

与kimi对比,讯飞星火包含了更多的功能和服务,如多模态交互、各种助手、插件等,这些功能的实现需要更多的开发时间和资源。估计初代版本的开发大约需要7-9month
参考讯飞星火认知大模型从1.0版本发展到3.5版本的迭代发展大概经历了8month:从5月6日发布V1.0版本开始,到8月15日发布V2.0版本,再到1月30日发布V3.5版本。
与专业团队相比,6名大学毕业生团队可能需要时间来学习和解决开发过程中遇到的复杂问题,因此估计开发时间为20-25month


(二)同类产品对比排名

1. kimi

  • 优势:

集成搜索能力:kimi具备搜索的能力,能够结合搜索结果为用户提供更全面的回答,这增加了其解决问题的能力和准确性。
多文件整合处理 :kimi支持一次性上传多个文件,并能较准确分析处理文件内容。
大容量文本处理:kimi能够支持最多20万字的输入和输出,适合处理大量文本信息,满足专业用户的需求。

  • 劣势:

功能限制:与一些竞争对手相比,Kimi可能在某些特定功能上存在限制,例如不支持图像识别、视频处理等多模态交互。

  • 排名:
    综上,Kimi在同类产品中具有一定的竞争力,估计排名在第5左右。

2.讯飞星火

  • 优势:

广泛的应用场景:讯飞星火可以应用于多个领域,如教育、金融、营销、文旅等,提供定制化的智能解决方案,满足不同行业的需求。
技术创新:讯飞星火在语言理解、数学能力方面超过了GPT-4,显示出其在某些技术领域的领先性。

  • 劣势:

不够精:在图像生成和图生文方面,虽然讯飞星火表现出一定的能力,但与GPT-4等模型相比,可能在细节处理和创意表现上还有提升空间。在文件处理方面,虽然讯飞星火也支持文件处理,但目前只支持单文件上传,与Kimi相比逊色很多。

  • 排名:
    综上,给出讯飞星火在同类产品中的排名大概为第3

(三)软件工程方面的建议

1. kimi

个人认为kimi这个软件非常实用,其联网搜索功能和多文件处理的特色功能都十分出色,这在一定程度上能够为kimi带来用户,但同类产品也在不断更新迭代进步,kimi想要保持自己的竞争力,就得在特色功能上进一步纵向发展。另外,在广度上,kimi可以适当增加一些功能的实现,比如语音输入、多媒体内容生成与输出等,避免用户的流失。

2. 讯飞星火

讯飞星火功能丰富综合实力强,对于其某些功能不够精与领先水平存在差异的问题,我的建议是:团队需要加大研发投入,探索和应用最新的人工智能技术和算法,以缩小差距并保持竞争力。


(四)BUG存在的原因分析

1. kimi

  • 展开资源后文字冗余:开发人员粗心大意、测试不够抠细节
  • 回复错误:版本控制不完善
  • 文件解析失败:构建和训练模型有缺陷

    2. 讯飞星火

  • 回复错误:构建和训练模型有缺陷
  • 某些助手功能缺陷:开发人员粗心大意、具体的设计质量不高

第三部分 建议和规划

(一)市场概况

1. 市场大小

根据量子位智库《2023中国AIGC产业全景报告》的预测,到2030年,全国AIGC市场规模将超过万亿人民币。Kimi与讯飞星火作为AI大模型的代表之一,其市场规模随着整个行业的增长而扩大。

在这里插入图片描述

2. 直接用户

  • Kimi的用户增长情况非常显著。从2023年12月至2024年2月,Kimi的月活跃用户数分别为50.83万、112.85万和298.46万人,分析师表示,目前Kimi模型的日活跃用户数已达100万人,预计月活跃用户数约为500万人。显示出用户基数的快速扩大。这些数据表明Kimi在短时间内吸引了大量新用户,并且用户基数在迅速扩大。
  • 讯飞星火的直接用户数量已经相当可观。据统计,与讯飞星火大模型直接相关的活跃用户数已达1200万。

    3. 潜在用户

    随着人工智能技术的普及和应用场景的不断拓展,越来越多的行业和个人将需要使用AI大模型来提高效率和创新能力。在中国,大约有800万软件从业人员,2022年软件行业的收入达10.8万亿元,占GDP比重达8.93%,预测到2028年软件行业收入翻番达到20万亿元。此外,随着软件团队的大力宣传,在社交媒体和网络平台上的知名度提升,潜在用户群体也在不断增加,预计为千万数量级。

(二)市场现状

1. 市场上已有的产品

2023年12月国内外大模型完整清单
目前市场上的AI大模型众多,以下是一些知名的AI大模型:

  • OpenAI的GPT系列
  • 百度的文心大模型
  • 腾讯的混元AI大模型
  • 阿里的M6和通义大模型
  • 华为的盘古系列大模型
  • 科大讯飞的讯飞星火大模型
  • 网易的玉言大模型
  • 360的360智脑大模型
  • 京东的言犀大模型
  • 月之暗面的kimi
  • ...

2. 两款产品的定位、优势与劣势

  • Kimi的市场定位是通过提供长文本阅读和概括能力,成为一个高学习力的免费私人助手,旨在提升用户的阅读效率和信息处理能力,主要面向C端用户。
  • 讯飞星火的定位不仅仅是一个智能对话助手,它面向更广泛的行业应用,通过提供行业大模型,满足不同领域的需求和挑战。

    3. 两款产品之间的关系与竞争态势。

  • 产品关系:Kimi和讯飞星火都是人工智能大模型产品,它们在AI领域内具有一定的竞争关系,同时也各自发展独特的产品特点和市场定位。
  • 竞争态势:Kimi在长文本处理和C端用户服务方面具有优势,而讯飞星火则在多模态能力和行业应用方面展现出其技术实力和市场影响力。随着技术的迭代和市场的变化,Kimi和讯飞星火可能会在某些领域出现更直接的竞争,也可能在其他领域寻求合作与共赢的机会。

    4. 领域所处阶段

    AI大模型领域正处于一个充满活力和潜力的成长阶段,随着技术的不断成熟和市场的认可,有望进入一个更广泛的应用和商业化的风口期。依据如下:
  • AI大模型在自然语言处理、图像识别、语音识别等多个方面取得了显著的技术突破
  • AI大模型的应用正在快速拓展到各个行业,包括但不限于教育、医疗、金融、娱乐等。
  • AI大模型相关的市场正在快速增长,投资也在不断增加。
  • 许多国家和地区都在积极推动人工智能技术的发展,并出台了一系列政策来支持AI产业的成长。

(三)市场与产品生态

1.核心用户

核心用户群体:对新技术有兴趣和需求的专业人士,他们通过使用AI大模型来提升工作效率和专业技能。
用户群体特征

  • 学历:可能具有较高的教育水平,包括中学生、大学生、研究生、博士生以及专业人士。
  • 年龄:以年轻和中年人群为主。
  • 专业:用户可能来自计算机科学、数据分析、科研、教育、金融、媒体等各种专业领域。
  • 爱好:对于科技创新、编程、数据分析、阅读和学习新知识等领域有浓厚兴趣。
  • 收入:涵盖低水平收入到高水平收入。
  • 表面需求:需要一个能够提供信息检索、数据分析、文档编辑、学习辅导等功能的智能助手。
  • 潜在需求:追求工作效率的提升、对知识的深入理解和创新能力的培养。

    2.用户群体之间的关系

  • 用户之间可能存在师生关系、同事关系或行业内的合作关系。
  • 可以通过构建开发者社区、在线论坛等平台促进用户之间的交流和协作,形成以技术创新和知识共享为核心的用户生态系统。

(四)产品规划

1. 新功能描述

基于kimi现有版本新增多媒体内容生成与输出功能。

  • N(Need,需求):用户在某些情况下需要的不仅仅是文字信息,还包括图表、图片、视频等多媒体内容。例如,用户可能需要可视化数据报告、教育材料中的插图或者社交媒体帖子的图片。
  • A(Approach,方法):开发一个功能,使kimi能够根据用户的请求生成和输出图片、图表、简单动画等多媒体内容。这可以通过集成现有的图像生成算法和AI艺术模型来实现。
  • B(Benefit,好处):1.增强用户体验,提高用户的满意度和参与度,更好地满足用户需求。2.能够扩展应用场景,从而扩展潜在用户群。3.提升市场竞争力。
  • C(Competitive,竞争):虽然市场上存在专门的多媒体生成工具,但将此类功能集成到一个多功能的人工智能助手中,将为Kimi提供独特的竞争优势。
  • D(D,推广):1.利用社交媒体、内容营销和技术博客来提高产品的在线可见度。2.与行业内的影响者合作,通过他们的推荐来吸引潜在用户。3.举办线上和线下的研讨会或工作坊,展示新功能的实际应用,并收集用户反馈。

    2. 配置角色

  • 项目经理(1人):负责整体项目规划、进度跟踪和资源协调。
  • UI/UX设计师(1人):负责设计用户界面和多媒体内容的展示方式。
  • 前端开发工程师(1人):负责实现多媒体内容的前端展示和用户交互。
  • 后端开发工程师(1人):负责集成图像生成算法和处理多媒体内容的存储与传输。
  • 机器学习工程师(1人):负责开发和优化多媒体内容生成的AI模型。
  • 测试工程师(1人):负责编写测试用例、执行测试和质量保证。

    3. 十六周规划

    周数计划内容
    1-2项目启动会议,明确目标和里程碑;团队成员熟悉项目背景和技术栈。
    3-4需求分析和功能规划
    5-6技术选型和原型设计
    7-8用户反馈与原型改进
    9-12主要开发阶段
    13初步测试
    14用户体验测试
    15发布功能
    16收集用户反馈进行功能迭代优化
...全文
354 回复 打赏 收藏 转发到动态 举报
写回复
用AI写文章
回复
切换为时间正序
请发表友善的回复…
发表回复
内容概要:本文系统研究了基于CNN-SVM的卷积神经网络与支持向量机融合的数据分类预测方法,聚焦其在工业故障识别中的应用,提供了完整的Matlab代码实现。通过CNN提取输入数据的深层空间特征,再由SVM进行高精度分类,充分发挥两者优势,有效提升了故障识别的准确性、鲁棒性与泛化能力。该方法特别适用于处理电力系统、机械设备等领域的高维、非线性、强噪声监测数据,在变压器故障诊断、轴承缺陷识别等场景中具有重要应用价值。文档还整合了机器学习、深度学习、图像处理、路径规划、电力系统优化等多个前沿科研方向的技术资源,配套大量Matlab/Simulink仿真案例与Python代码,全面支持科研复现与工程实践。; 适合人群:具备一定编程基础,熟练掌握Matlab或Python语言,从事电气工程、自动化、人工智能、机械故障诊断等相关领域研究的研发人员及高校研究生; 使用场景及目标:① 实现工业设备的状态监测与多类别故障分类;② 深入理解CNN与SVM融合模型的设计原理与工程实现细节;③ 借助所提供的丰富算法案例开展科研复现、模型优化与系统仿真验证; 阅读建议:建议按照文档目录结构系统化学习,结合百度网盘提供的完整代码资源进行动手实践,重点关注CNN特征提取层与SVM分类器之间的数据接口设计与参数调优策略,同时可延伸学习文中涉及的其他智能算法及其在电力系统、信号处理等领域的交叉应用,全面提升科研创新能力。

122

社区成员

发帖
与我相关
我的任务
社区描述
FZU-SE
软件工程 高校
社区管理员
  • LinQF39
  • 助教-吴可仪
  • 一杯时间
加入社区
  • 近7日
  • 近30日
  • 至今
社区公告
暂无公告

试试用AI创作助手写篇文章吧