最新AI资源

共 3143 篇文章
阶跃深研 - 阶跃星辰推出的AI深入研究工具

阶跃深研 - 阶跃星辰推出的AI深入研究工具

阶跃深研是阶跃星辰推出的高效AI研究工具,能在短时间内自主完成复杂问题的研究并生成专业报告。工具专为金融、咨询、医疗、法律等领域设计,凭借深度搜索与信息整合能力,在行业评测中表现优异。
1年前
055.8K
VLAC - 上海AI Lab开源的具身奖励大模型

VLAC - 上海AI Lab开源的具身奖励大模型

VLAC是上海人工智能实验室开源的具身奖励大模型。以InternVL多模态大模型为基础,融合互联网视频数据和机器人操作数据,为机器人在真实世界中的强化学习提供过程奖励和任务完成情况估计。VLAC能有效...
11个月前
054.9K
CWM - Meta FAIR开源的代码世界语言模型

CWM - Meta FAIR开源的代码世界语言模型

CWM(Code World Model)是Meta FAIR团队发布的一款320亿参数的开源代码世界语言模型,专为代码生成和推理设计。引入“世界模型”概念,能模拟代码执行过程,预测变量状态变化,提前...
10个月前
054.4K
Neovate Code - 蚂蚁开源的智能编程助手

Neovate Code - 蚂蚁开源的智能编程助手

Neovate Code 是蚂蚁集团支付宝体验技术部开源的智能编程助手,通过人工智能技术提升开发效率。具备对话式开发功能,开发者可以通过自然语言描述需求,Neovate Code 能理解并生成相应的代...
10个月前
054K
Wan2.2-Animate - 通义万相开源的动作生成模型

Wan2.2-Animate - 通义万相开源的动作生成模型

Wan2.2-Animate是通义万相开源的动作生成模型,支持动作模仿和角色扮演两种模式。用户只需输入一张角色图片和一段参考视频,模型能将视频中角色的动作、表情迁移到图片角色中,赋予图片角色动态表现力...
10个月前
053.7K
SAM Audio - Meta推出的开源多模态音频分割模型

SAM Audio - Meta推出的开源多模态音频分割模型

SAM Audio是Meta推出的开源多模态音频分割模型,从复杂的音频混合中精准分离出任意目标声音。通过结合文本、视觉和时间维度的提示,实现灵活、高效的音频处理,为音频编辑、去噪、声音提取等任务提供了...
7个月前
053.4K
MedASR - 谷歌开源的医疗语音识别模型

MedASR - 谷歌开源的医疗语音识别模型

MedASR是谷歌开源的1.05亿参数医疗语音识别模型,在5000小时脱敏临床语料上微调,针对药品、剂量、解剖术语优化,内置6-gram医学语言模型,在私有放射科数据集RAD-DICT上词错率仅4.6...
7个月前
051.7K
GPT-5-Codex - OpenAI推出的最强编程模型

GPT-5-Codex - OpenAI推出的最强编程模型

GPT-5-Codex 是 OpenAI 推出的强大的编程优化模型,基于 GPT-5 进一步强化,专为软件工程师设计。模型能快速生成高质量代码,支持多种编程语言,且能优化现有代码提升性能。
11个月前
051.1K
GLM-TTS - 智谱AI推出的开源工业级语音合成系统

GLM-TTS - 智谱AI推出的开源工业级语音合成系统

GLM-TTS 是智谱推出的开源工业级语音合成系统,具备强大的语音合成能力。采用两阶段生成架构:第一阶段将文本转换为语音令牌序列,第二阶段将令牌序列转换为高质量音频。系统支持仅用3秒语音样本即可完成音...
8个月前
050.4K