GTSinger – 浙大开源的大型多语言高质量歌声数据集
GTSinger是什么 GTSinger是由浙江大学研究团队推出的大型开源高质量歌声数据集,旨在支持多样化的歌声任务。GTSinger包含80.59小时的专业录音棚录制的歌声,...
MLE-bench – OpenAI推出AI代理性能评估的基准测试工具
MLE-bench是什么 MLE-bench 是 OpenAI 推出的一个基准测试工具,旨在衡量AI代理(AI Agent)在机器学习工程任务中的表现。测试包含75个来自 Kaggle 的竞赛任...
摆平AI论文 – AI论文写作助手,专为学生和研究人员打造
摆平AI论文是什么 摆平AI论文是专为学生和研究人员打造的AI论文写作助手,基于人工智能技术,提供一键生成论文、降重润色、校园作业生成等服务。支持多种论文...
ScriptViz – 斯坦福大学推出的剧本可视化AI辅助工具
ScriptViz是什么 ScriptViz是由斯坦福大学研究人员推出的一款剧本可视化辅助工具,基于大型电影数据库MovieNet,根据剧本文本和对话检索出相匹配的电影画面,...
Loong – 港大和字节联合推出的长视频生成模型
Loong是什么 Loong是由香港大学和字节跳动联合推出的一种新型长视频生成模型,能生成外观一致、动态丰富、场景过渡自然的分钟级长视频。模型基于自回归大型语...
Illuminate – 谷歌推出将学术论文转化为音频讨论的AI项目
Illuminate是什么 Illuminate 是一个由谷歌开发的项目,能将学术论文转化为人工智能生成的音频讨论。项目基于谷歌强大的语言模型 Gemini,将论文内容转换成引...
Surya – 开源的OCR工具包,支持90+语言、布局分析等识别
Surya是什么 Surya是一款功能强大的开源OCR(光学字符识别)工具包,专门设计用在文档识别,支持超过90种语言的识别。Surya能准确识别出文档中的文本,分析文...
揽睿星舟 – 翼方健数自主研发的云端AI训推一体算力平台
揽睿星舟是什么 揽睿星舟是一个云端AI训推一体算力平台,由翼方健数自主研发。提供高性价比的GPU计算资源、开箱即用的训推环境及AI工具链,旨在解决AI协作过...
MM1.5 – 苹果推出的升级版多模态大模型
MM1.5是什么 MM1.5是苹果公司推出的多模态大型语言模型,旨在增强文本丰富图像理解、视觉指代和定位以及多图像推理能力。模型基于数据为中心的训练方法,在大...
Cooraft – AI照片转换风格化应用,基于快手开源LivePortrait项目
Cooraft是什么 Cooraft是一款基于AI技术,将普通照片转化为具有创意和艺术性的动画和渲染图的应用程序。Cooraft提供多种艺术风格,如3D卡通、经典绘画等,一...