122
社区成员
发帖
与我相关
我的任务
分享| 这个作业属于哪个课程 | 2302软件工程 |
|---|---|
| 这个作业要求在哪里 | 软件工程实践——软件评测作业 |
| 这个作业的目标 | 学会对产品进行调研评测与分析,并给出建议和规划 |
| 其他参考文献 | 《构建之法》 |
讯飞星火是一款语音交互开发工具,提供了丰富的基本功能,主要包括以下几个方面
1、语音识别:
讯飞星火能够将用户的语音输入转换为文本,实现语音转文字的功能。
支持多种语言的语音识别,包括中文、英文等。

2、语音合成:
讯飞星火可以将文字转换为自然流畅的语音输出,实现文字转语音的功能。
提供多种音色和语速选择,可根据需求调整语音合成效果。

3、多平台支持:
讯飞星火支持多种开发语言和平台,包括Java、Python、Android、iOS等,可以在不同的开发环境中使用。
提供了丰富的开发文档和示例代码,帮助开发者快速上手。

优点:
语音输入和识别:讯飞星火提供了便捷的语音输入功能,并且其语音识别技术通常表现出色,能够准确地将用户的语音转换成文字形式。
智能问答:软件拥有一个庞大的知识库和智能问答系统,可以为用户提供各种领域的问题解答和建议,覆盖面广泛。
多功能性:除了语音识别和智能问答功能外,讯飞星火可能还提供了其他实用功能,比如语音助手、翻译等,增强了用户体验。
交互体验:软件通常具有简洁直观的用户界面,操作流程相对简单,用户可以轻松地进行操作和获取信息。
缺点:
覆盖范围有限:尽管讯飞星火的知识库庞大,但仍然可能无法覆盖所有领域和所有问题,特别是一些较为专业或者新颖的问题。
准确度不稳定:虽然讯飞星火的语音识别和智能问答通常表现良好,但在某些情况下可能会出现识别错误或者给出不够准确的答案,准确度不稳定。
依赖网络连接:讯飞星火需要连接互联网才能使用,如果网络连接不稳定或者速度较慢,可能会影响到用户的使用体验和服务质量。
个人隐私问题:作为一款智能软件,讯飞星火可能需要收集和分析用户的语音数据以提供更好的服务,这可能引发一些个人隐私方面的担忧。
提升语音识别准确度:进一步优化语音识别算法,提升准确度和稳定性,尽量减少识别错误的发生,增强用户体验。
增强个性化推荐:根据用户的历史查询记录和偏好,提供个性化的搜索结果和推荐,使用户能够更快速地找到所需信息。
离线功能支持:增加离线功能支持,使用户在没有网络连接的情况下仍然能够使用部分功能,提高软件的可用性和稳定性。
a. 采访对象的背景,为什么选择这个人采访?TA的需求是什么?
福州大学软件工程学生,需求是ppt自动生成
b. 描述采访对象实际使用的产品栏目
智能ppt生成
c. 采访对象使用软件的过程中会遇到的问题和亮点
选择主题后,会自动拆分大纲 ,无需输入大纲
d. 采访对象觉得从用户体验的角度来说需要改进的地方有哪些?
提供更多的ppt风格供用户选择

1.讯飞星火大模型的界面打开devtool/开发者工具就会跳转到空白界面
2.垂直标签浏览器界面下,打开讯飞星火网站直接跳转空白界面


操作系统:Windows 10 家庭中文版 64位(10.0 内部版本19045)
计算机平台:R7000p
浏览器:Microsoft Edge:123.0.2420.65 (正式版本) (64 位)
1、正常进入讯飞星火网站,打开开发人员工具,跳转空白界面
2、将浏览器“显示当前所有浏览器窗口的垂直标签”启用,打开讯飞星火网站,跳转空白界面
可能原因:
1.讯飞星火的web端有防护,在web端直接按 F12 不能打开开发者窗口
2.页面监听了控制台打开事件,打开后则跳转到空白页(对窗口大小的检测方法会误伤侧边栏)
严重性:3星,无法打开开发者工具 会影响用户体验或功能不如预期,但不会影响系统的核心功能,可以在下一个版本中修复。
定性结论:
一般。作为一款语音交互开发工具,其有必须的功能,提供API接入等。且还有其他综合的插件功能,例如:ppt自动生成。虽然无法与专业的aippt竞争,但作为综合性插件,也算不错了。
定量结论:
满分 10 分, 良好 6 分, 及格 4 分,聊胜于无 1 分, 很差 -3 分
| 类别 | 描述 | 评分 |
|---|---|---|
| 核心功能 | 核心功能的功能设计和质量 | 6 |
| 细节 | 为用户考虑的细节 | 4 |
| 用户体验 | 当用户完成功能时,不干扰用户 | 4 |
| 辅助功能 | 一些辅助功能如皮肤等 | 6 |
| 差异化功能 | 软件独特的功能 | 10 |
| 软件的效能 | 占用内存, 启动速度, 内存泄漏情况 | 1 |
| 软件的适应性 | 在联网/断网, 大小屏幕, 没有鼠标的情况下都可以顺畅操作. 和不同平台的软件能流畅协作 | -3 |
| 成长性 | 记住用户的选择, 适应用户的特点,用户越用越方便 | -3 |
| 用户有控制权 | 用户方便地从错误中恢复工作, 快捷操作键可调整。 | 6 |
| 内容质量 | 网站所提供信息的真实性、全面性、权威性、及时性 | 6 |
| 最终得分 | 80-100,非常好。50-79,良好。30-49,一般。0-29,差。 | 37 |
Kimi是一款面向普通用户(C端)的智能助手,旨在提供高效的信息查询和对话服务。
支持”长文本“,即能够消化大量的内容,和用户进行持续的交流:

它可以提供了一些围绕文件内容的问题,让用户可以持续学习:

优点:
Kimi和其他的C端大模型产品相比,支持”长文本“,即能够消化大量的内容,和用户进行持续的交流。人机对话时,AI需要记住用户输入的文字或者文件内容,并给出相应的答复,kimi的记忆力足够强,支持200万字,它可以读完用户上传的一个几百页的报告或者书籍,并对这份报告加以总结,或者回答用户问题。
缺点:
Kimi和其他的C端大模型产品相比。没有支持流行的多模态(生成图片、视频)、插件和智能体功能
个性化定制功能: 引入个性化定制功能,让用户能够根据自己的喜好和习惯对kimi.ai进行定制,从而提供更符合用户需求的服务和推荐。
多模态交互支持: 支持多种交互方式,如语音、图像等,以满足用户在不同场景下的需求,并提高用户体验。
扩展生态系统: 扩展kimi.ai的生态系统,与第三方服务和平台进行集成,提供更丰富的功能和服务,满足用户多样化的需求。




bug分析:
① 答案重复:Kimi 给出的答案,在跨轮次中没有重复,但在同一轮次中会出现重复条目。
② 汇总 bug:要求 Kimi 将前序轮次查询到的信息进行汇总时,就陷入了死循环。(空间有限,只截图到 122 行,实际最终到 336 行才结束输出)
定性结论:
它自己本身的定位是超长记忆AI助手,能够支持约20万汉字的上下文输入,这个长度足以让我们导入一部中长篇小说让其理解并回答问题。
这个功能很适合用来进行文档速读,能够帮我们快速了解长篇文档的内容,从中提炼出需要的信息,节省大量时间。它可以直接上传文档,并且支持多种文档格式,非常方便。
定量结论:
满分 10 分, 良好 6 分, 及格 4 分,聊胜于无 1 分, 很差 -3 分
| 类别 | 描述 | 评分 |
|---|---|---|
| 核心功能 | 核心功能的功能设计和质量 | 10 |
| 细节 | 为用户考虑的细节 | 1 |
| 用户体验 | 当用户完成功能时,不干扰用户 | 4 |
| 辅助功能 | 一些辅助功能如皮肤等 | 6 |
| 差异化功能 | 软件独特的功能 | 6 |
| 软件的效能 | 占用内存, 启动速度, 内存泄漏情况 | 1 |
| 软件的适应性 | 在联网/断网, 大小屏幕, 没有鼠标的情况下都可以顺畅操作. 和不同平台的软件能流畅协作 | -3 |
| 成长性 | 记住用户的选择, 适应用户的特点,用户越用越方便 | -3 |
| 用户有控制权 | 用户方便地从错误中恢复工作, 快捷操作键可调整。 | 4 |
| 内容质量 | 网站所提供信息的真实性、全面性、权威性、及时性 | 6 |
| 最终得分 | 80-100,非常好。50-79,良好。30-49,一般。0-29,差。 | 32 |
讯飞星火:
讯飞星火要达到一定程度需要的时间因很多因素而异,例如团队成员的经验水平、项目的复杂度、资源投入等。一般来说,一个有6人团队的软件项目,如果有专业UI支持,可能需要至少6个月到1年的时间来开发一个初步可用的版本,具体时间取决于项目的具体要求和团队的工作效率。如果需要更复杂的功能或者更高的质量,可能需要更长的时间。
kimi:
大约需要1年多的时间来实现相似水平的成果。这个时间范围内,他们将有足够的资源和专业技能来开发出一个初步可用的版本,尤其是有专业UI支持的情况下。不过,具体时间会受到项目复杂性、团队协作效率等因素的影响。
讯飞星火:
优势:
劣势:
同类产品排名估计:
讯飞星火在国产大模型中表现突出,位列国内前三。在全球范围内,虽然与GPT-4等国际领先的大模型相比仍有差距,但讯飞星火V3.5已经在多个维度上展现出与GPT-4不分伯仲的实力6。因此,我们可以估计讯飞星火在同类产品中的排名非常靠前,具体名次可能受到不同评价标准和测试场景的影响,但无疑是国内领先的水平,并且在全球范围内也具有较强的竞争力。
kimi:
优势:
劣势:
同类产品排名估计:
Kimi.ai在安全性、准确性和多语言对话能力方面具有明显优势,这使得它在同类产品中具有竞争力。然而,由于无法创建文档和提供下载链接等功能的限制,它可能在某些特定场景下不如一些功能更全面的人工智能助手。考虑到Kimi.ai的独特优势和一些功能限制,它在同类产品中的排名可能会处于中上水平。具体排名会受到市场动态、用户需求和技术发展的影响,因此难以给出一个固定的位置。
讯飞星火:
kimi:
讯飞星火:
第三方依赖问题:现代软件往往依赖于第三方库或服务。如果这些依赖存在问题,或者与软件的其他部分不兼容,可能会导致软件运行异常,出现bug。
上网搜索得知:讯飞星火认知大模型目前使用了 disable-devtool 这个第三方库来监听浏览器的开发者工具 ,对窗口大小的检测方法会误伤侧边栏。
kimi:
测试覆盖率不足:软件在发布前需要经过详尽的测试,以确保其稳定性和可靠性。如果测试覆盖率不足,可能会遗漏一些边缘情况或特定场景下的bug
1、市场规模
AI大模型市场的规模正在迅速扩大。据8预测,到2023年,中国人工智能市场支出规模将增至147.5亿美元,约占全球总规模的十分之一。而6的数据显示,中国AI芯片市场规模从2019年的116亿元增至2022年的850.2亿元,年均复合增长率为64.5%。此外,11指出,中国的大模型供给方已达254家,其中北京约占一半,表明市场活跃度高,增长潜力巨大。
2、直接用户
直接用户大部分指的是那些直接使用AI大模型服务的企业。这些公司和团队是AI大模型的直接用户,他们利用大模型开发各种应用,推动技术的商业化和产业化。
3、潜在用户
潜在用户是指那些可能未来会使用AI大模型服务的企业和个人。随着AI技术的普及和应用领域的不断拓展,潜在用户群体将非常庞大。例如,提到,AI大模型在办公、制造、金融、医疗、政务等场景中降本增效、生产自动化、降低风险、提高诊断准确率、提高政务服务效率等诉求。这些行业的企业和机构都是潜在用户。此外,随着技术的成熟和应用案例的增多,个人用户也将逐渐成为AI大模型的重要用户群体。
市场上的AI大模型产品
产品定位、优势与劣势
竞品关系与市场态势
市场阶段
AI大模型市场目前正处于“成长”阶段。随着技术的不断进步和应用场景的日益丰富,AI大模型正在从研究和开发阶段转向规模化应用阶段。企业对于AI大模型的需求不断增长,市场规模也在快速扩大。同时,随着技术的成熟和成本的降低,AI大模型正逐渐从高科技领域走向更广泛的行业和消费者市场。
AI大模型软件的核心用户群通常包括对人工智能技术有需求的企业和个人开发者。这些用户可能来自各行各业,如科技、金融、教育、医疗、媒体和娱乐等,他们需要利用AI大模型来提升工作效率、创新产品或服务、优化决策过程、增强数据分析能力等。
典型用户可能具备以下特征:
用户的群体之间可能存在合作关系,例如企业用户可能需要与开发者合作来定制特定的AI模型,或者不同行业的用户可能共享某些AI应用的最佳实践。通过构建一个平台或社区,可以促进用户之间的交流和协作,从而形成活跃的用户生态系统,推动知识共享、技术进步和商业模式创新。
产品的子产品和其他相关产品之间也可能存在协同效应。例如,一个专注于自然语言处理的大模型可以与计算机视觉领域的产品相结合,提供多模态的智能分析服务。通过整合不同的产品和技术服务,可以构建一个综合性的AI解决方案生态系统,满足用户在不同场景下的需求,增强用户体验和产品价值。
功能名称:多模态交互增强
为何要做这个功能: 当前AI大模型软件主要侧重于文本处理和生成,但随着技术的发展和用户需求的多样化,单一模态的交互方式已经无法满足所有用户的需求。多模态交互增强功能将结合文本、语音、图像等多种输入和输出方式,提供更自然、直观的用户体验。
为何用户会用你的产品/功能: 用户越来越习惯于与智能设备进行自然交流,多模态交互增强功能能够让用户以更接近人类沟通的方式与AI系统互动,提高工作效率和满意度。
创新点:
团队配置:
每周详细规划: