122
社区成员
发帖
与我相关
我的任务
分享| 这个作业属于哪个课程 | 2302软件工程 |
|---|---|
| 这个作业要求在哪里 | 软件工程实践——软件评测作业 |
| 这个作业的目标 | 调研,评测,分析,建议和规划 |
| 其他参考文献 | 《构建之法》 |
@
Kimi是由月之暗面科技有限公司开发的人工智能助手,旨在为用户提供高效、智能的服务体验。Kimi擅长处理中文和英文的对话,能够阅读和理解多种格式的文件,如TXT、PDF、Word文档、PPT幻灯片和Excel电子表格等。Kimi的核心能力包括:文件阅读与理解、互联网访问、多语言对话、信息检索。
- 详情:
进入网站后还未进行登录时,无法使用各功能,点击页面各交互按钮都会跳出登录页面。
- 优点:
- 不仅是右上角的登录按钮,点击各交互按钮都可以自动跳出登录页面,方便用户登录。
- 缺点:
- 我认为在未登录的情况下不能发送问题提问这是较合理的,但是所有的功能都不能使用可能会使第一次使用的用户不想花时间进行功能的了解、失去耐心,从而转向其他功能类似的产品,造成不必要的用户流失。
- 改进建议:
- 我注意到在为这个页面中间发送问题框下面是一些“超长文本的例子”,这应该是一些指令模板。对于这类模板可以设计成在用户未登录情况下依旧可以发送并收到正确回答。这样就可以让用户能够快速了解产品功能,吸引用户兴趣。
- 详情:
与未登录界面相比,登录后界面左上角增加了“历史对话”按钮可以滑动查看历史对话,右上角个人信息部分也有相应变化,可以更换深/浅模式、进行用户反馈。
- 优点:
- 页面中心logo下slogon的跳动显示具有良好的互动效果。
- 支持深/浅模式切换,可以更好满足不同用户的审美需求以及习惯。
- 历史会话部分按时间先后排序,页面简洁,结构清晰。
- 支持根据会话内容在离开会话时将未命名的会话自动命名,方便用户离开会话后能够在历史会话中快速定位到该会话。
- 缺点:
- 模式仅能选择深/浅模式,可能无法满足全部用户的需求。
- 会话的自动命名只进行一次,即只根据第一次问答的内容进行命名,当用户接着在这个会话提问了与之前毫不相关的问题时,此时会话名与内容显然对应不上。
- 历史会话仅能根据时间罗列所有会话,当会话数量过多时,用户想找到较早之前的会话较为困难。
- 改进建议:
- 可以推出更多主题模式供用户选择。
- 在用户对会话命名前,根据最新的用户问题重复对会话进行自动命名。而在用户对会话命名后则不再对该会话自动命名。
- 历史会话部分新增一个搜索功能,可根据会话内容关键字搜索之前的会话。
- 详情:
这是一个基本会话页面,输入你的问题后按回车或发送按钮(输入框右侧的飞机图标)后可得到Kimi的回复,并且回复完成后Kimi会提供一些相关的问题。
点击会话下拉框有“修改名称”、“分享”、“删除”功能,可以对每一条问答进行“复制”、“再试一次”、“分享”、“点赞”、“点踩”操作。
会话下拉框的“分享”与回答的“分享”并不完全算是重复功能,前者会自动选中本次会话所有问答,而后者仅会选中当次问答内容,两者用户都可根据需求全选、选中或取消勾选某条信息。
分享可以通过链接分享(点击链接可以进入到当前会话查看与继续对话)、文本复制分享、图片分享(支持预览)。
- 优点:
- 对话功能响应较快,回复后的相关问题推荐十分给力,若推荐正确能够大大方便用户。
- 分享功能设计合理,能够很好满足用户需求,给用户好的体验。
- 缺点:
- “再试一次”功能对于某些问题并没有不同的回答,而是抹除原来的回答后将一模一样的回答再次输出,浪费用户时间。
- “点赞”与“点踩”功能作用不明显,用户并不知道按下这两个按钮之后有什么效应。
- 改进建议:
- “再试一次”功能对问题若没有不同的回复,则不再次输出回复而是通过弹窗等组件提醒用户“抱歉,我没有其他答案”之类的消息。
- “点赞”与“点踩”处理点击之后图标变蓝外,相应增加弹窗等组件提醒“收到!这是一条有价值的回复,之后会增加该类型回复的使用。”/“收到!这是一条低价值的回复,之后会减少该类型回复的使用。”来增加用户交互。
在这部分进行几个问答测试,检验kimi的语言理解能力与知识丰富性。
- 语义理解:得到的结果较为准确,且分点回答,结构清晰
- 情感分析:分析了句子的拟人手法,回答正确。
- 逻辑推理:结果错误(正确答案:刘刚妹妹小红,马辉妹妹小英,李强妹妹小丽)。
- 金融专业问题:回答正确。
- 理工专业问题:回答正确且内容完善。
- 详情:
用户可以根据自己的需求和习惯,定制一套适合自己的常用语。在与Kimi的对话中,用户可以通过简单的触发词或者指令来快速调用预设的常用语,无需再次手动输入完整的句子。
示例:我经常向Kimi提问福州名探的天气,那么我可以将“”明天福州天气如何设为常用语,为添加关键词为“天气”,这样之后我想提问时只需要输入“天气”,Kimi就会自动展开为预设的完整语句。
除了可以自定义常用语,Kimi也提供了随机的常用语,包含了一些常用的场景。
- 优点:
- 根据个人习惯定制Kimi的常用语是一个简单且个性化的过程,可以减轻用户的记忆负担,让用户与Kimi的交流更加高效和便捷。
- 个人很喜欢的一个小设计:在设置常用语后,Kimi会根据常用语内容自动生成一个常用语图标,如上例“天气”常用语的太阳图标。不仅在美观方面起到了一定作用,在常用语逐渐多起来之后,这个小设计将帮助用户快速理清现有的常用语。
- 随机常用语可以缓解用户的交流疲劳,增加用户与Kimi互动的乐趣,另外也为用户如何定制常用语提供了很好的范本。
- 缺点:
- 以下图为例,Kimi的随机常用语中有“影视推荐”,用户想定义一个类似的常用语却不小心把它刷过了之后只能自己定义(用户一般很难写出Kimi提供的随机常用语那样详细的指令)或者再点击“换一个”按钮直到出现刚才的“影视推荐”,这样就给用户带来了不好的体验。
4.改进建议:
- 增加提供的常用语并增加常用语搜索功能,还可以再用户定义常用语的时候分析并弹出相关的定义好的常用语供用户选择。
- 详情:
联网功能使得Kimi能够即时搜索互联网上的信息,为用户提供最新的数据和答案。
进行网络搜索的时候,会有搜索的步骤动态交互展示,搜索完成,输出内容时折叠展示,可展开查看。
- 优点:
- 通过连接到互联网,Kimi可以访问大量的在线知识库和数据库,为用户提供更全面、更深入、更实时的答案和解释。Kimi可以根据网络上的最新信息和数据进行自我更新,保持信息的时效性和准确性。
- 搜索时动态的交互展示让用户明确感知到系统正在响应需求,并且进行了相应的动作,减少了用户等待的焦虑。
- 网上资源用户需要时可展开,展示结构清晰。
- 从网络上获取的相关资料带超链接,方便用户进行深度的研究和分析。
- 缺点:无
- 改进建议:无
- 详情:
用户可以上传TXT、PDF、Word文档、PPT幻灯片和Excel电子表格等格式的文件,Kimi能够阅读这些文件内容并根据内容回答用户的问题。
我们可以发现,在上传文件后,kimi会自动关闭联网功能,鼠标移到该、联网功能图标上时,kimi给出了简短的解释“上传文件或网址后,已自动关闭联网模式”。
对于这个解释,我并不满意,因此我向kimi提问了这个问题以得到详细解释。kimi的回答是为了保护用户隐私和数据安全。
接着我又试着上传更多文件,当文件内容过多时,将不能发送这些文件跟kimi进行问答,kimi会提示“kimi只能阅读全部文件的*%,请删减后发送”,当慢慢删减文件数量时,kimi会实时计算出可阅读全部文件的百分比,直至这个百分比达到100%,这时就可以发送此时的全部文件进行问答了。
我一共上传了18个文件,其中有两个文件没有按章节顺序,有一个文件重复上传了两次。
这是kimi对上面上传文件给出的核心内容整理。
- 优点:
- kimi能够准确读取文件内容并且响应时间快。
- 归纳能力强,能很好地归纳出内容要点,并且给出的回复结构简洁清晰,便于用户查看与理解。
- 对于重复的文件,kimi会智能地省略重复的文件内容回复,使回复内容更加简洁清晰。
- 缺点:
- kimi虽然理解了每个文件的内容,但是回复时没有根据文件内容排序,而是根据用户上传文件的顺序。我认为这较不合理,有这么一个场景:当用户向kimi提供了几个打乱的小说章节的文件,kimi没办法根据文件内容给出阅读顺序,而需要用户一个个看文件的概要内容来自己判断阅读顺序。以上只是一个简单的例子,更有一些工作或学习上的场景需要这项功能。
- 注意到我上传了18个文件,而kimi只给出了16个文件的内容要点归纳,除去一个重复的文件,kimi漏掉了一个文件的解读。
- kimi对重复文件的要点归纳只回复一次也存在一点小缺陷,用户可能一时无法意识到是由于自己上传了重复的文件导致kimi给出的回复跟自己上传的文件数量不一致,而得一个个查找kimi漏掉了哪个文件,浪费时间。
- 改进建议:
- kimi在回复时能够智能地根据文件内容给出排好序的回复结构。
- kimi在折叠了重复文件的回复时,在回复最后一行提醒用户“识别到您上传了*个重复的文件(具体文件名),回复中已折叠”。
- 采访对象:福大22级软件工程学生
- ta的需求:通过AI问答解决学习上的问题,使用AI工具方便一些办公
- 采访记录:
| 等级 | 描述 | 量化标准 | 影响范围 | 用户体验 |
|---|---|---|---|---|
| ★★★★★ | 致命性问题 | - 系统完全崩溃 - 严重的安全性漏洞 - 无法恢复的数据丢失 | 整个系统 | 完全无法使用 |
| ★★★★ | 严重问题 | - 重要功能失效 - 服务器鉴权漏洞 - 重要数据泄露 | 系统的关键部分 | 较差,无法完成关键任务 |
| ★★★ | 中等问题 | - 次要功能失效 - 部分数据丢失或错误 - 轻微的安全性问题 | 系统的某些部分 | 一般,部分功能受限 |
| ★★ | 小问题 | - 用户界面的小问题 - 偶尔的性能下降 - 非关键数据的错误 | 个别功能 | 基本无影响,小的不便 |
| ★ | 建议性问题 | - 改进建议 - 性能优化 - 用户体验提升 | 非功能性 | 无影响,但有提升空间 |
- 具体情况描述:
在使用了联网功能找到问题相关资料时,用户点击展开网上资源后,最下方有一行“找到了*篇资料作为参考:”显然不应该出现在这里。
- 可复现性: 必然发生
- 可能原因:UI设计可能存在缺陷,导致在展示搜索结果时未能正确处理或隐藏与设计不符的元素。这可能是由于前端开发中的编码错误或者布局问题。
- 严重性:★
- 改进建议:对相关的前端代码进行审查和测试,以发现并修复可能导致问题的代码。
- 具体情况描述:
在使用文件上传功能之前,我询问了kimi相关问题,并没有得到正确的回答。
- 可复现性:必然发生
- 可能原因:Kimi可能经过了更新或改进,但相关功能的描述没有及时同步更新,导致提供的信息与当前功能状态不一致。
- 严重性:★★
- 改进建议:定期检查和更新Kimi的描述和文档,确保信息的准确性和时效性。
- 具体情况描述:
对于某些文件,kimi可能出现解析失败的情况,但还是能够正常查看文件。
一开始我以为是文件过大的原因,但我试着上传了更大的文件,发现kimi能够成功解析。
不过文件较大,kimi需要开启一个新会话,并且无法解析文件全部内容(超出kimi字数限制,kimi能够处理的最大文本输入为20万字)。
- 可复现性:
对于某些文件必然发生- 可能原因:
这是kimi对不能解析某些文件原因的回复。
- 严重性:★★★★
- 改进建议:
- 一些文件可能包含复杂的结构,如嵌套表格、多层次的目录结构或复杂的图表,增强对这些复杂文件结构的处理算法。
- 用户不知道为什么kimi会解析失败,对此建议kimi在解析失败时给出相应的解析失败的原因以便用户能够就原因进行调整。
定性结论:d) 好,不错
定量结论:
参考现代软件工程 团队作业 - 软件分析和用户需求调查 (2013 - 2014)
设计下面的软件评价得分表,得分80-100:非常好。50-79:良好。30-49:一般。0-29:差。
| 评分维度 | 描述 | 评分标准 | 得分 |
|---|---|---|---|
| 核心功能(20) | 分析AI大模型软件的三个核心功能,包括功能设计和质量。 | - 功能的实现程度 - 功能的创新性 - 功能的稳定性和可靠性 | 15 |
| 用户细节(10) | 评估AI软件是否提供了为用户考虑的细节。 | - 用户个性化选项 - 易用性设计 - 辅助功能和工具 | 8 |
| 用户体验(10) | 评估用户在使用AI软件时的整体体验。 | - 界面设计和交互 - 无干扰操作 - 用户反馈处理 | 8 |
| 辅助功能(10) | 评估AI软件提供的辅助功能,如皮肤、主题等。 | - 功能多样性 - 定制化程度 - 用户满意度 | 7 |
| 差异化功能(20) | 评估AI软件独特的功能及其对用户的吸引力。 | - 功能的独有性 - 功能的实际价值 - 用户的接受度 | 18 |
| 适应性(10) | 评估AI软件在不同环境下的适应性和兼容性。 | - 跨平台兼容性 - 网络环境适应性 - 设备适配性 | 7 |
| 成长性(10) | 评估AI软件是否能够根据用户行为进行学习和适应。 | - 用户习惯记忆 - 自我优化能力 - 个性化推荐 | 5 |
| 自选评分项目(10) | 社会影响 | - 推动行业的发展 | 9 |
| 总分(100) | —— | —— | 77 |
讯飞星火认知大模型,是科大讯飞研发的以中文为核心的新一代认知智能大模型,能够在与人自然的对话互动的过程中,同时提供以下多种能力:内容生成能力、语言理解能力、知识问答能力、推理能力、多题型步骤级数学能力、代码理解与生成能力。讯飞星火大模型可以对多元能力实现融合统一,对真实场景下的需求,具备提出问题、规划问题、解决问题的闭环能力。
- 详情:
页面中间上部是招呼与语与简短的简介,中部是一些讯飞星火助手(可在未登录情况下点击),下部是提问输入框。
- 优点:
- 整个页面配色柔和,符合大部分人审美。排版合理,结构清晰。
- 在未登录情况下用户可点击一些讯飞星火助手,虽然只是简单的给出一个该助手的使用示例,但能够有效让用户快速了解讯飞星火的功能。
- 缺点:无
- 改进建议:无
- 详情:
登录后页面与未登录页面相比多了下图框里的元素
- 优点:
- 页面中心的“为您推荐”以及输入框上方的一排“插件”占据了页面主体部分,用户能够快速上手使用讯飞星火的各种功能。
- 缺点:
- 界面较为杂糅,有种眼花缭乱的感觉,对想要深入了解讯飞星火的用户
比如有测评作业的我不是很友好,需要花费时间边使用使用边摸索着了解。比如“为您推荐”部分其实是推荐一些助手,而左侧部分已经明确了“助手中心”这一功能。另外,在头像旁的下拉菜单里的功能不太容易被用户发现。- 输入框上面的插件栏不支持左右滑动查看,对习惯使用触控板的用户不太友好。
- 改进建议:
- 进一步规划页面分区,适当减少“为您推荐”部分页面占比,将下拉菜单的“发音人”,“Q&A指南”,“指令推荐”分离出来,可在左侧增加相应功能(个人认为这三个功能还是蛮重要的)。
- 输入框上面的插件栏增加左右滑动查看功能。
- 详情:讯飞星火支持文本输入、语音输入、图片输入
输入“/”可获取指令模板,可在模板基础上修改
另外还具有指令优化功能
- 优点:
- 多种输入方式可以满足不同用户的需求,提高输入效率和便利性。
- 通过输入“/”获取指令模板,可以帮助用户快速了解和使用各种指令,提高操作效率。
- 用户可以在模板基础上进行修改,使其更符合自己的需求,提高个性化体验。
- 可以对已输入的指令进行优化,提高指令的准确性和执行效率。
- 缺点:
- 虽然讯飞星火支持语音输入,但语音识别的准确性可能会受到环境、发音等因素的影响,导致识别错误。
- 图片输入可能受到图片质量、分辨率等因素的影响,导致识别效果不佳。
- 改进建议:
- 提高语音识别准确性,并增加语音输入的反馈机制,让用户在识别错误时能够快速纠正。
- 使用更高级的图像处理和分析算法,以提高对不同质量和分辨率图片的识别能力。
在这部分进行几个问答测试,检验kimi的语言理解能力与知识丰富性。
- 语义理解:没有很好地理解,结果不准确
- 情感分析:回答正确且提炼。
- 逻辑推理:结果错误(正确答案:刘刚妹妹小红,马辉妹妹小英,李强妹妹小丽)。
- 金融专业问题:回答正确。
- 理工专业问题:回答正确,但与kimi的回答相比参考价值不高。
- 详情:
用户可以直接由“为你推荐”选择适合的助手进行问答
也可以从助手中心里查找想要的助手
- 优点:
- 助手非常多,功能丰富。
- 在会话里由“为您推荐”直接使用助手十分方便。
- 点击“助手中心”时,“历史对话”列表会自动切换到“助手列表”,方便用户查看已使用过的助手。
- 助手中心里的助手非常多,讯飞星火很好地解决了如何组织这些助手的问题,有“首页”、“分类”、“我的”三种范围,还有搜索功能,可以帮助用户快速找到想要的助手。
每个助手都会有一个“热度”,可以方便用户选择大众筛选出来的相对好用的助手。
- 缺点:
- 我在助手中心收藏了几个计算机软件相关的助手后刷新发现“为你推荐”部分并没有变化,我又换了个账号发现“为你推荐”部分推荐的助手是一样的,说明讯飞星火并没有根据用户的使用习惯、兴趣偏好和任务需求等因素进行个性化推荐。
- 虽然有热度值,但在同类型助手里,助手的排列并没有按热度进行,用户若有需要需自己挑选最热助手。
- 改进建议:
- 进一步优化“为你推荐”部分的算法,实现根据用户的使用习惯、兴趣偏好和任务需求等因素进行个性化推荐。
- 在同类型助手里,助手的排列按热度进行。
- 详情:
讯飞星火插件集成了讯飞及合作伙伴的多项人工智能技术,具备强大的智能化能力。目前上线的优质插件包括PPT生成、简历生成和文档问答等插件,满足用户在不同场景下的需求。
以使用“智能PPT生成”插件为例,未勾选插件下的回复如下
勾选插件后的回复如下,可以看出讯飞星火先是创建了PPT大纲,并且支持修改,当觉得大纲没问题后可以直接“一键生成PPT”
用户可以选择想要的配色,等待一会便可生成成功并自动跳转到生成的PPT。
- 优点:
- 讯飞星火大模型插件集合了众多实用功能,为用户提供了一站式的办公解决方案,使工作更加高效便捷。
- 缺点:
- 会话使用了某个插件之后便只能一直使用该插件,既不能取消也不能换其他插件。这是如果用户想使用其他插件必须开启一个新会话。并且必须在初始会话就选择插件,若进行了对话,则插件选择栏就会消失。
- 我还使用了“文档问答”插件,该插件与kimi“上传文件”功能类似,但只支持单文件上传。回答内容没有很好概括文件,也没有清晰的分点回答。因此可以看出有些插件功能并不是非常完善。
- 改进建议:
- 考察分析并进一步修改插件栏的出现时机。
- 进一步完善各插件功能,为用户带来更好体验。
- 采访对象:福大22级软件工程学生
- ta的需求:通过AI问答解决学习上的问题,使用AI工具方便一些办公
- 采访记录:
| 等级 | 描述 | 量化标准 | 影响范围 | 用户体验 |
|---|---|---|---|---|
| ★★★★★ | 致命性问题 | - 系统完全崩溃 - 严重的安全性漏洞 - 无法恢复的数据丢失 | 整个系统 | 完全无法使用 |
| ★★★★ | 严重问题 | - 重要功能失效 - 服务器鉴权漏洞 - 重要数据泄露 | 系统的关键部分 | 较差,无法完成关键任务 |
| ★★★ | 中等问题 | - 次要功能失效 - 部分数据丢失或错误 - 轻微的安全性问题 | 系统的某些部分 | 一般,部分功能受限 |
| ★★ | 小问题 | - 用户界面的小问题 - 偶尔的性能下降 - 非关键数据的错误 | 个别功能 | 基本无影响,小的不便 |
| ★ | 建议性问题 | - 改进建议 - 性能优化 - 用户体验提升 | 非功能性 | 无影响,但有提升空间 |
- 具体情况描述:在提问了金融专业问题后又在同一个会话提问了理工专业的问题,讯飞星火没有给出正确回答,而仍旧回复金融专业问题的答案。并且点击“重新回答”也无济于事!
- 可复现性:必然发生
- 可能原因:模型可能错误地识别了我的意图,将其归类为与前一个问题相关的跟进问题,而不是一个全新的问题。
- 严重性:★★★
- 改进建议:通过更好的用户意图识别技术,区分新问题和对旧问题的跟进,从而提供恰当的回答。
- 具体情况描述:在助手中心里随机找了一个热度较小(2.1w)的助手——英语提问老师,发现其并不能正常使用。可以看出我并没有输入任何字符,而是它自己在自言自语,并且这个助手只有两种回复...
- 可复现性:必然发生
- 可能原因:1.这个助手可能处于Beta测试阶段,已经通过了初步的内部测试,但还需要在真实用户环境中进行进一步的测试和验证。2.可能存在审核流程中的疏漏或者对测试阶段助手的定义和要求不够明确,导致一些功能在未完全准备好的情况下就被审核通过。
- 严重性:★★
- 改进建议:1.制定更为严格的审核标准和流程,确保每个助手在对外开放前都经过详尽的功能和安全测试。2.对于测试阶段的助手,应当在明显位置告知用户其测试状态,使用户有充分的知情权。
定性结论:d) 好,不错
定量结论:
| 评分维度 | 描述 | 评分标准 | 得分 |
|---|---|---|---|
| 核心功能(20) | 分析AI大模型软件的三个核心功能,包括功能设计和质量。 | - 功能的实现程度 - 功能的创新性 - 功能的稳定性和可靠性 | 16 |
| 用户细节(10) | 评估AI软件是否提供了为用户考虑的细节。 | - 用户个性化选项 - 易用性设计 - 辅助功能和工具 | 8 |
| 用户体验(10) | 评估用户在使用AI软件时的整体体验。 | - 界面设计和交互 - 无干扰操作 - 用户反馈处理 | 7 |
| 辅助功能(10) | 评估AI软件提供的辅助功能,如皮肤、主题等。 | - 功能多样性 - 定制化程度 - 用户满意度 | 7 |
| 差异化功能(20) | 评估AI软件独特的功能及其对用户的吸引力。 | - 功能的独有性 - 功能的实际价值 - 用户的接受度 | 15 |
| 适应性(10) | 评估AI软件在不同环境下的适应性和兼容性。 | - 跨平台兼容性 - 网络环境适应性 - 设备适配性 | 7 |
| 成长性(10) | 评估AI软件是否能够根据用户行为进行学习和适应。 | - 用户习惯记忆 - 自我优化能力 - 个性化推荐 | 6 |
| 自选评分项目(10) | 社会影响 | - 推动行业的发展 | 7 |
| 总分(100) | —— | —— | 73 |
在使用了kimi和讯飞星火的全部功能之后,我估计的基于一个由6名计算机专业大学毕业生组成的团队,并有专业的UI支持开发到这种程度的大致时间估计如下:
从项目启动到发布,可能需要大约5-7个月的时间。
- 需求分析和规划(2-3week)
- 技术分析和原型设计(3-4week)
开发和测试(12-16week)
测试和迭代(4-6week)
部署和发布(1-2week)
与kimi对比,讯飞星火包含了更多的功能和服务,如多模态交互、各种助手、插件等,这些功能的实现需要更多的开发时间和资源。估计初代版本的开发大约需要7-9month。
参考讯飞星火认知大模型从1.0版本发展到3.5版本的迭代发展大概经历了8month:从5月6日发布V1.0版本开始,到8月15日发布V2.0版本,再到1月30日发布V3.5版本。
与专业团队相比,6名大学毕业生团队可能需要时间来学习和解决开发过程中遇到的复杂问题,因此估计开发时间为20-25month。
- 优势:
集成搜索能力:kimi具备搜索的能力,能够结合搜索结果为用户提供更全面的回答,这增加了其解决问题的能力和准确性。
多文件整合处理 :kimi支持一次性上传多个文件,并能较准确分析处理文件内容。
大容量文本处理:kimi能够支持最多20万字的输入和输出,适合处理大量文本信息,满足专业用户的需求。
- 劣势:
功能限制:与一些竞争对手相比,Kimi可能在某些特定功能上存在限制,例如不支持图像识别、视频处理等多模态交互。
- 排名:
综上,Kimi在同类产品中具有一定的竞争力,估计排名在第5左右。
- 优势:
广泛的应用场景:讯飞星火可以应用于多个领域,如教育、金融、营销、文旅等,提供定制化的智能解决方案,满足不同行业的需求。
技术创新:讯飞星火在语言理解、数学能力方面超过了GPT-4,显示出其在某些技术领域的领先性。
- 劣势:
不够精:在图像生成和图生文方面,虽然讯飞星火表现出一定的能力,但与GPT-4等模型相比,可能在细节处理和创意表现上还有提升空间。在文件处理方面,虽然讯飞星火也支持文件处理,但目前只支持单文件上传,与Kimi相比逊色很多。
- 排名:
综上,给出讯飞星火在同类产品中的排名大概为第3。
个人认为kimi这个软件非常实用,其联网搜索功能和多文件处理的特色功能都十分出色,这在一定程度上能够为kimi带来用户,但同类产品也在不断更新迭代进步,kimi想要保持自己的竞争力,就得在特色功能上进一步纵向发展。另外,在广度上,kimi可以适当增加一些功能的实现,比如语音输入、多媒体内容生成与输出等,避免用户的流失。
讯飞星火功能丰富综合实力强,对于其某些功能不够精与领先水平存在差异的问题,我的建议是:团队需要加大研发投入,探索和应用最新的人工智能技术和算法,以缩小差距并保持竞争力。
根据量子位智库《2023中国AIGC产业全景报告》的预测,到2030年,全国AIGC市场规模将超过万亿人民币。Kimi与讯飞星火作为AI大模型的代表之一,其市场规模随着整个行业的增长而扩大。

2023年12月国内外大模型完整清单
目前市场上的AI大模型众多,以下是一些知名的AI大模型:
核心用户群体:对新技术有兴趣和需求的专业人士,他们通过使用AI大模型来提升工作效率和专业技能。
用户群体特征:
基于kimi现有版本新增多媒体内容生成与输出功能。
| 周数 | 计划内容 |
|---|---|
| 1-2 | 项目启动会议,明确目标和里程碑;团队成员熟悉项目背景和技术栈。 |
| 3-4 | 需求分析和功能规划 |
| 5-6 | 技术选型和原型设计 |
| 7-8 | 用户反馈与原型改进 |
| 9-12 | 主要开发阶段 |
| 13 | 初步测试 |
| 14 | 用户体验测试 |
| 15 | 发布功能 |
| 16 | 收集用户反馈进行功能迭代优化 |