Zen Browser - 基于Firefox内核的开源AI网页浏览器Zen Browser是基于Firefox内核的开源浏览器,主打简洁高效的浏览体验,核心特色是垂直标签栏和工作区隔离功能。采用侧边栏设计,能清晰展示50+个标签页的完整标题,支持多窗口分屏浏览。最新AI资源9个月前066.2K
DeepSearchQA - 谷歌开源的AI研究Agent测试基准DeepSearchQA是谷歌开源的AI研究Agent测试基准,专门用于评估智能体在复杂多步查询任务中的表现。包含900个手工设计的"因果链"任务,覆盖17个领域,要求AI像人类研究员一样通过多步骤推...最新AI资源9个月前066.2K
InternVLA·M1 - 上海AI Lab开源的具身双系统操作“大脑”InternVLA·M1 是上海人工智能实验室开源的具身操作“大脑”,是面向指令跟随的双系统操作大模型。构建了覆盖“思考-行动-自主学习”的完整闭环,负责高阶的空间推理与任务规划。模型采用两阶段训练策...最新AI资源1年前066.2K
混元图像2.1 - 腾讯推出的开源文生图模型混元图像2.1(HunyuanImage 2.1)是腾讯推出的开源文生图模型,专为高质量图像生成设计。模型支持原生2K分辨率,能精准呈现复杂场景和细节,使人物表情和动作能生动还原。最新AI资源1年前066.1K
Mistral Vibe - Mistral AI推出的开源命令行编码助手Mistral Vibe是Mistral AI推出的开源命令行编码助手,基于Devstral模型开发,支持自然语言交互完成代码搜索、文件操作、版本控制等任务。能自动扫描项目结构和Git状态,通过@符号...最新AI资源9个月前066.1K
NovaSR - 开源的音频超分辨率模型,提升音频采样率NovaSR是开源的音频超分辨率模型,主要用于将低质量音频(如16kHz采样率的电话音质)提升为高质量音频(如48kHz采样率的录音室级音质)。模型大小仅52KB,比一张微信表情包还小,可轻松部署在资...最新AI资源8个月前066.1K
小艺Claw - 华为推出的个人手机AI助理,一键接入OpenClaw小艺Claw是华为基于OpenClaw开源框架推出的AI智能体,集成于小艺App中。小艺Claw打破传统语音助手"被动应答"的交互逻辑,具备自主规划与任务执行能力,可独立完成办公文档处理、信息检索、服...最新AI资源6个月前066.1K
Neovate Code - 蚂蚁开源的智能编程助手Neovate Code 是蚂蚁集团支付宝体验技术部开源的智能编程助手,通过人工智能技术提升开发效率。具备对话式开发功能,开发者可以通过自然语言描述需求,Neovate Code 能理解并生成相应的代...最新AI资源12个月前066.1K
微信ClawBot - 微信官方推出连接 OpenClaw 的 AI 插件微信ClawBot是微信官方推出的AI插件,核心定位是连接OpenClaw(开源AI智能体框架)与微信的消息通道。用户只需在部署OpenClaw的设备上执行一条命令完成安装,可通过微信聊天界面直接发送...最新AI资源6个月前065.9K
PromptFill - 开源的结构化提示词生成AI工具,专为AI绘画设计PromptFill是专为AI绘画设计的结构化提示词生成工具,通过可视化的“填空”交互方式,帮助用户快速构建、管理和迭代复杂的Prompt,提升AI图像生成的效率与质量。PromptFill的核心功能...最新AI资源9个月前065.9K
UniPixel - 香港理工、腾讯、中科院等开源的像素级多模态模型UniPixel是香港理工大学、腾讯、中国科学院和vivo等机构联合提出的新型多模态模型,实现像素级视觉语言理解。通过统一对象指代和分割能力,支持多种细粒度任务,如图像分割、视频分割、区域理解以及Pi...最新AI资源11个月前065.8K
Code2Video - Show Lab开源的AI教学视频生成框架Code2Video是创新的开源项目,能将代码片段自动转换为高质量的视频内容(mp4格式)。项目通过独特的代码中心范式,使用carbon-now-cli工具将代码生成精美的图片,利用ffmpeg将这些...最新AI资源11个月前065.8K
MiroFish - 开源的AI预测引擎,智能体进行自由交互与社会演化MiroFish是中科大20岁学生BaiFu开源的AI预测引擎,基于多智能体技术,能从新闻、小说等种子信息自动构建高保真平行数字世界。最新AI资源6个月前065.8K
T5Gemma 2 - 谷歌开源的新一代编码器-解码器模型T5Gemma 2 是谷歌开源的新一代编码器 - 解码器模型,基于 Gemma 3 架构升级而来,具备多模态和长上下文处理能力。支持文本和图像等多种数据类型,能处理超长上下文(最高 128K),在生成...最新AI资源9个月前065.6K
InsForge - 专为 AI 编程代理设计的开源后端平台InsForge是专为AI编程代理设计的开源后端平台,由PostgreSQL和PostgREST构建,提供身份验证、存储、边缘函数等全栈服务。通过"语义层"将后端操作封装为AI可理解的标准化指令,支持...最新AI资源4个月前065.5K
Audio2Face - NVIDIA开源的AI 3D面部动画生成模型Audio2Face是NVIDIA开源的能将音频输入转化为逼真的3D面部动画AI工具。通过分析音频中的语音特征,如音素和语调,生成精确的唇部同步和细腻的情感表达,为虚拟角色赋予生动的人类表情。最新AI资源12个月前065.4K
MAI-UI - 阿里通义实验室开源的通用GUI智能体基座模型MAI-UI是阿里巴巴通义实验室开源的通用GUI智能体基座模型,具备跨应用操作、模糊语义理解、主动用户交互和多步骤流程协调四大能力。采用端云协同架构,轻量模型驻守设备处理日常任务,复杂任务可调用云端大...最新AI资源9个月前065.2K
PilotDeck - 清华、面壁智能、OpenBMB等开源的Agent 操作系统PilotDeck 是清华大学 THUNLP 实验室、面壁智能、OpenBMB 与 AI9Stars 联合研发并开源的 Agent 操作系统。以WorkSpace(工作舱)为核心架构,为每个任务提供独...最新AI资源4个月前065.1K
Mini-o3 - 字节、港大联合开源的视觉推理模型Mini-o3是字节跳动和香港大学联合推出的开源模型,专注于解决复杂视觉搜索问题。模型具备强大的多轮交互推理能力,能通过深度探索和试错定位目标。最新AI资源1年前065.1K
Baichuan-M3 - 百川智能开源的新一代医疗大语言模型Baichuan-M3是百川智能推出的新一代开源医疗大语言模型,专为医疗场景深度优化,具备强大的医疗推理和问诊能力。在权威的HealthBench评测中以65.1分的综合成绩位列全球第一,超越了GPT...最新AI资源8个月前064.9K
GPT-5-Codex - OpenAI推出的最强编程模型GPT-5-Codex 是 OpenAI 推出的强大的编程优化模型,基于 GPT-5 进一步强化,专为软件工程师设计。模型能快速生成高质量代码,支持多种编程语言,且能优化现有代码提升性能。最新AI资源1年前064.8K
OctoCodingBench - MiniMax开源面向Coding Agent标准的评测集OctoCodingBench是MiniMax开源的首个面向Coding Agent生产级标准的评测集,核心创新在于通过Check-level准确率(CSR)和Instance-level成功率(IS...最新AI资源8个月前064.8K
Bernini - 字节跳动开源的视频生成与编辑统一框架Bernini是字节跳动开源的视频生成与编辑统一框架,采用"先理解,再生成"的协同架构:MLLM Planner深度解析文本指令与视觉输入,DiT Renderer将其转化为高质量连续视频。最新AI资源4个月前064.8K
PersonaLive - 澳门大学等开源的实时AI人像动画生成直播框架PersonaLive是开源的实时AI换脸直播框架,由澳门大学、dzine.ai和大湾区大学GVC实验室联合开发。能在普通消费级显卡(12GB显存)上实现低延迟、高帧率的数字人驱动,支持通过摄像头实时...最新AI资源9个月前064.7K
SurfSense - 开源的AI研究与知识管理工具,NotebookLM最强平替SurfSense 是开源的 AI 研究与知识管理工具。高度可定制,能连接搜索引擎、Slack、Jira、Notion、YouTube、GitHub 等众多外部数据源,方便用户整合信息。用户可上传多种...最新AI资源9个月前064.7K
Devstral 2 - Mistral AI 推出的新一代编程模型家族Devstral 2是Mistral AI 推出的针对软件工程任务设计的新一代编程模型家族,包含 Devstral 2(123B 参数)和 Devstral Small 2(24B 参数)两个版本。D...最新AI资源9个月前064.6K
Paperclip - 开源的AI Agent编排平台,管理和协调多个AI智能体Paperclip是开源的AI代理编排平台,定位为“零人工公司操作系统”,用于管理和协调多个AI代理(如OpenClaw、Claude Code等)协同工作。提供组织架构、目标对齐、预算控制、任务追踪...最新AI资源6个月前064.6K
OpenAutoGLM - 智谱AI开源的手机AI Agent模型OpenAutoGLM 是智谱AI开源的具有“手机使用”能力的智能体模型,能通过多模态感知理解手机屏幕内容,自动生成操作流程来完成用户指定的任务。用户只需用自然语言描述需求,如“打开美团搜索附近的火锅...最新AI资源9个月前064.5K
Hunyuan-MT-7B - 腾讯混元开源的轻量级翻译模型Hunyuan-MT-7B 是腾讯混元团队推出的轻量级翻译模型,参数量为70亿,支持33个语种及5种民汉语言/方言的互译,包括粤语、维吾尔语、藏语等。在国际计算语言学协会(ACL)WMT2025比赛中...最新AI资源1年前064.4K
Genie Sim 3.0 - 智元机器人开源首个大语言模型驱动的仿真平台Genie Sim 3.0是智元机器人发布的首个大语言模型驱动的开源仿真平台。基于NVIDIA Isaac Sim构建,融合三维重建、视觉生成技术与物理引擎,实现毫米级精准复刻真实环境,通过自然语言指...最新AI资源8个月前064.4K
SkyClaw - Skywork AI 推出的云端AI Agent工作空间SkyClaw 是 Skywork AI 推出的云端持久化智能工作空间,定位超越传统对话机器人的"主动执行型代理"。支持在 Slack、Discord、WhatsApp 等主流平台原生集成,能基于用户...最新AI资源6个月前064.3K
HunyuanOCR - 腾讯混元开源的光学字符识别专家模型HunyuanOCR是腾讯混元团队开源的高性能光学字符识别模型,参数量仅10亿。基于混元多模态架构开发,采用端到端设计,能高效处理文字检测、识别及文档解析任务。模型在复杂文档测试中得分94.1分,超越...最新AI资源10个月前064.2K
阶跃深研 - 阶跃星辰推出的AI深入研究工具阶跃深研是阶跃星辰推出的高效AI研究工具,能在短时间内自主完成复杂问题的研究并生成专业报告。工具专为金融、咨询、医疗、法律等领域设计,凭借深度搜索与信息整合能力,在行业评测中表现优异。最新AI资源1年前064.1K
Youtu-Embedding - 腾讯优图开源的通用文本表示模型Youtu-Embedding 是腾讯优图实验室开源的通用文本表示模型,专为企业级应用设计。通过深度神经网络将文本映射到高维向量空间,使语义相似的句子在该空间中距离更近,实现精准的语义检索。最新AI资源11个月前064.1K
RoboBrain-X0 - 智源研究院开源的零样本跨本体泛化具身模型RoboBrain-X0是智源研究院开源的全球首个支持零样本跨本体泛化的开源具身模型,具有重要的行业意义。能在无需微调的情况下,驱动多种不同构造的真实机器人完成基础操作任务,在少量样本微调后展现出对复...最新AI资源12个月前064K
XTuner V1 - 上海AI Lab开源的大模型训练引擎XTuner V1 是上海人工智能实验室开源的新一代大模型训练引擎,专为超大规模稀疏混合专家(MoE)模型训练设计。基于 PyTorch FSDP 开发,通过显存、通信和负载等多维度优化,实现了高性能...最新AI资源1年前064K
rStar2-Agent - 微软开源的高效AI推理模型rStar2-Agent是微软开源的先进的人工智能数学推理模型,在AIME24测试中达到80.6%的准确率,展现出强大的数学问题解决能力。模型具备科学推理能力,在GPQA-Diamond基准测试中达到...最新AI资源1年前063.9K
Qwen3-Next - 阿里通义推出的最新基础模型Qwen3-Next是阿里通义开源的新一代混合架构大模型,结合了Gated DeltaNet和Gated Attention技术,擅长处理长文本,推理速度快且节省计算资源。最新AI资源1年前063.8K
肉包 - 开源AI手机自动化助手,能看懂屏幕自动执行肉包(Roubao)是开源的AI手机助手,让用户用现有Android手机能体验类似"豆包手机"的智能自动化功能。肉包基于视觉语言模型,能看懂屏幕内容并自动执行复杂任务,从点外卖、发微信到跨App操作...最新AI资源6个月前063.8K
AlphaClaw - 熵简科技推出的金融投研 AI Agent 工具AlphaClaw 是熵简科技推出的金融投研 AI 工具,搭载于 AlphaEngine 平台,被誉为"投研小龙虾"。完成了从"有问必答的 AI 助手"向"自主执行的 AI 分析师"的进化,能独立跑通...最新AI资源6个月前063.7K
RynnBrain - 阿里巴巴达摩院开源的具身智能大脑基础模型RynnBrain 是阿里巴巴达摩院开源的具身智能大脑基础模型,为机器人提供深度环境理解和物理世界交互能力。是业界首个赋予机器人时空记忆和物理空间推理能力的开源模型。包含2B、8B、30B等7个不同参...最新AI资源7个月前063.6K
PixVerse V6 - 爱诗科技推出的最新一代AI视频生成模型PixVerse V6是爱诗科技推出的最新一代AI视频生成模型。在保持秒级生成速度的同时,重点优化了人物真实感、复杂运动表现、物理模拟及声画协同能力,支持最长15秒1080P视频生成。最新AI资源6个月前063.6K
DiaMoE-TTS - 清华联合巨人网络开源的多方言语音合成框架DiaMoE-TTS 是清华大学和巨人网络联合开源的多方言语音合成框架,基于国际音标(IPA),解决方言数据稀缺、正字法不一致和音系变化复杂等问题。通过统一的 IPA 前端标准化音素表示,消除跨方言差...最新AI资源11个月前063.5K
Infographic - 阿里AntV团队开源的信息图生成框架Infographic是阿里AntV团队开源的新一代框架,基于G2和Ant Design开发,专注于快速生成高质量信息图,提供30+布局模板、120+预设主题及AI智能生成功能。最新AI资源9个月前063.5K
Fun-Audio-Chat-8B - 阿里通义开源的端到端语音交互大模型Fun-Audio-Chat-8B是阿里通义团队开源的80亿参数端到端语音大模型,直接语音进语音出,无需ASR+LLM+TTS拼接,中文英文双语流利,延迟低、音色自然。采用双分辨率共享LLM与25Hz...最新AI资源9个月前063.4K
DreamOmni2 - 港科大开源的多模态AI图像编辑与生成模型DreamOmni2是港科大贾佳亚团队开源的多模态AI图像编辑与生成模型。能同时处理文本和图像指令,支持多张参考图,为创作者提供更灵活的创作方式。模型采用三阶段数据合成流程进行训练,联合训练生成/编辑...最新AI资源11个月前063.4K
LongCat-Flash-Thinking - 美团开源的高效推理模型LongCat-Flash-Thinking 是美团 LongCat 团队发布的高效推理模型,在保持 LongCat-Flash-Chat 极速的同时,变得更强大、更专业。模型在逻辑、数学、代码、智能...最新AI资源1年前063.2K
Lynx - 字节跳动开源的高保真视频生成模型Lynx 是字节跳动开源的高保真个性化视频生成模型,仅需单张人像照片,能生成身份一致的视频。基于扩散 Transformer(DiT)基础模型构建,引入 ID-adapter 和 Ref-adapte...最新AI资源12个月前063.1K
Claude Tag - Anthropic 推出的 Slack 原生 AI 协作功能Claude Tag 是 Anthropic 推出的 Slack 原生 AI 协作功能,将 Claude 从个人聊天工具升级为团队常驻成员。用户只需在 Slack 频道中输入 @Claude 即可分配...最新AI资源3个月前062.9K
Ling-V2 - 蚂蚁百灵开源的MoE架构语言模型系列Ling-V2 是蚂蚁百灵团队推出的基于 MoE 架构的大型语言模型家族,首个版本 Ling-mini-2.0 拥有 160 亿总参数,每个输入标记仅激活 14 亿参数。最新AI资源12个月前062.9K
MiniCPM5-1B - 面壁智能联合清华、OpenBMB开源的端侧文本基座模型MiniCPM5-1B 是面壁智能联合清华大学与 OpenBMB 开源社区发布并开源的新一代端侧文本基座大模型。模型以仅 10 亿(1B)的参数规模,在国际权威榜单 AA-Index(Artifici...最新AI资源4个月前062.8K
Step 3.5 Flash - 阶跃星辰开源的 1960 亿稀疏 MoE 模型Step 3.5 Flash 是阶跃星辰开源的 1960 亿稀疏 MoE 模型,每 token 仅激活 110 亿参数,能在代码任务跑出 350 token/s 的实时速度。基于自研 MTP-3 多 ...最新AI资源8个月前062.7K
Pyscn - 专为Python开发者开源的免费AI代码质量分析工具Pyscn是专为Python开发者设计的智能代码质量分析工具,主要用于检测代码中的潜在问题以提升可维护性。通过控制流图分析死代码、利用APTED+LSH算法识别重复代码,计算模块耦合度和圈复杂度等指标...最新AI资源11个月前062.5K
Intern-S1-Pro - 上海AI Lab开源的首个万亿参数科学多模态大模型Intern-S1-Pro是上海人工智能实验室开源的全球首个万亿参数级科学多模态大模型。采用512专家MoE架构,激活仅8专家22B参数,兼顾性能与效率。模型基于SAGE架构,引入傅里叶位置编码,统一...最新AI资源7个月前062.5K
Androidify - 谷歌开源如何在Android上构建AI应用的免费资源Androidify 是谷歌开源的帮助开发者学习如何在 Android 上构建 AI 驱动的应用项目。项目使用了谷歌最新的技术,如 Jetpack Compose、Gemini API(通过 Fire...最新AI资源11个月前062.4K
Mamoda2.5 - 字节跳动 Mamoda Team 推出的统一多模态生成模型Mamoda2.5 是字节跳动 Mamoda Team 研发的全球首个 25B 级统一多模态生成模型,模型基于自回归-扩散(AR-Diffusion)框架,采用 Qwen3-VL-8B 理解模块与 D...最新AI资源4个月前062.1K
MobileLLM-R1 - Meta开源的专项高效推理模型系列MobileLLM-R1是Meta开源的系列高效推理模型,专为数学、编程和科学推理设计。包含基础模型和最终模型,分别有1.4亿、3.6亿和9.5亿参数版本。模型并非通用聊天模型,是经过监督微调(SFT...最新AI资源1年前062K
陪读蛙 - 开源的 AI 翻译浏览器扩展插件陪读蛙(Read Frog)是前字节跳动软件工程师 mengxi-ream 开源的 AI 浏览器扩展插件,定位为"沉浸式语言学习助手",通过 AI 技术将日常网页阅读转化为语言学习过程,支持在原文旁直...最新AI资源4个月前061.9K
HiClaw - 阿里云开源的多智能体团队协作系统HiClaw 是阿里云开源的多 Agent 协作框架,让单个用户能像指挥团队一样调度多个 AI 员工。系统设置一位 Manager 管家负责拆解任务、分配工作,各 Worker 专精不同领域且相互隔离...最新AI资源6个月前061.8K
混元世界模型1.1 - 腾讯混元发布的开源3D重建大模型混元世界模型1.1(WorldMirror)是腾讯混元团队发布的开源3D重建大模型,是混元世界模型系列的升级版本。支持多视图图像、视频以及相机位姿、内参、深度图等多模态先验输入,突破了传统3D重建仅依...最新AI资源11个月前061.7K
EverMemOS - 盛大团队推出的开源长期记忆操作系统EverMemOS是陈天桥领导的盛大团队推出的开源长期记忆操作系统,专为AI智能体设计,解决大语言模型因固定上下文窗口导致的记忆断裂问题。系统基于人类大脑记忆机制,采用四层架构(代理层、记忆层、索引层...最新AI资源10个月前061.6K
Anijam - Dzine 推出的端到端一体化 AI 动画创作平台Anijam 是 Dzine 推出的 AI 驱动动画创作平台,用 AI Agent 为任何故事制作动画。并非简单的单片段视频生成工具,是一个端到端的一体化动画工作室。最新AI资源4个月前061.6K
KoalaQA - 开源的AI售后服务系统,帮企业快速搭建问答平台KoalaQA 是开源的智能售后服务系统,由 Chaitin 团队开发。基于 AI 大模型,提供 AI 客服、AI 搜索和知识库管理等功能,帮助企业快速搭建智能问答平台。系统支持 24/7 实时应答...最新AI资源9个月前061.2K
DeepSeek-V3.2-Exp - DeepSeek最新开源的实验性AI模型DeepSeek-V3.2-Exp是DeepSeek开源的实验性AI模型,通过引入DeepSeek Sparse Attention(DSA)机制,显著提升长文本处理的效率。模型基于DeepSeek...最新AI资源12个月前061.2K
OpenHuman - 开源桌面个人 AI 助手,能主动理解用户的数字同事OpenHuman是开源的个人AI助手项目,由Tiny Humans AI团队开发,解决传统AI助手缺乏长期记忆和上下文理解能力的问题。定位为“个人AI操作系统”或“数字分身”,目标是让AI从被动响应...最新AI资源4个月前061.1K
豆包2.1 - 字节跳动发布的最新旗舰大模型系列豆包2.1(Doubao-Seed-2.1)是字节跳动发布的最新旗舰大模型系列,包含Pro和Turbo两个版本,专为Coding与Agent时代打造。编程能力上,在Terminal Bench 2.1...最新AI资源3个月前061K
Xiaomi OneVL - 小米技术开源的一步式潜空间语言视觉推理框架Xiaomi OneVL 是小米技术团队发布并全面开源的一步式潜空间语言视觉推理框架,专为自动驾驶场景设计。框架在业内首次将VLA(视觉-语言-动作)模型、世界模型与潜空间推理三大技术路线统一到单一架...最新AI资源4个月前060.9K
腾讯Marvis - 腾讯推出操作系统层级的个人AI助手腾讯Marvis(中文名“马维斯”)是腾讯推出的操作系统层级的个人AI助手,帮助用户更高效地管理电脑和日常任务。可直接访问操作系统底层,支持文件管理(如搜索、整理、格式转换)、系统设置调整(如关闭广告...最新AI资源4个月前060.8K
YouClaw - Chat2DB 开源的极简 AI Agent 桌面客户端YouClaw 是 Chat2DB 团队推出的极简 AI Agent 桌面客户端,主打"最懂你的 AI 个人助理"定位。基于 Tauri 2 + React 构建,安装包仅约 30MB,支持 Wind...最新AI资源6个月前060.8K
SenseNova-MARS - 商汤科技开源的多模态搜索推理Agent语言模型SenseNova-MARS 是商汤开源的首个支持动态视觉推理与图文搜索深度融合的智能体视觉语言模型(Agentic VLM),提供 8B 和 32B 双版本。模型能自主规划任务步骤、调用多种工具(如...最新AI资源8个月前060.8K
DuClaw - 百度智能云推出的OpenClaw云部署服务DuClaw是百度智能云推出的托管式OpenClaw服务,专为无技术背景用户设计。DuClaw免除了服务器配置、镜像选择和API密钥管理的繁琐步骤,用户订阅后可在网页端直接调用完整的智能体功能。最新AI资源6个月前060.7K
ClipSketch AI - 开源的AI视频转手绘分镜工具,支持B站、小红书ClipSketch AI是开源的视频转手绘分镜工具,专为短视频创作者设计。能将B站、小红书等平台的视频一键转换为手绘风格故事板,支持标记关键帧、自动生成分镜和社交文案,能融合用户自定义角色。最新AI资源9个月前060.4K
Paper2Video - 新加坡国立开源的学术论文自动生成演示视频项目Paper2Video 是新加坡国立大学 Show Lab 开源的学术论文自动生成演示视频项目。通过 PaperTalker 多智能体框架,将论文转化为包含幻灯片、字幕、语音和演讲者头像的完整演示视频...最新AI资源11个月前060.4K
Vidi2 - 字节跳动开源的多模态视频理解与生成大模型Vidi2是字节跳动开源的第二代多模态视频理解与生成大模型,专注于视频内容的理解、分析和创作。支持文本、视频、音频三种模态的联合输入,能同时理解画面内容、声音信息以及自然语言指令,实现跨模态的交互与推...最新AI资源10个月前060.3K
Seedance 2.0 - 字节Seed团队推出的第二代多模态AI视频生成模型Seedance 2.0 是字节跳动(TikTok母公司)Seed团队开发的第二代多模态AI视频生成模型,代表了从单纯文本/图像转视频工具向专业级电影制作平台的重大升级,支持文本、图像、视频片段和音频...最新AI资源6个月前060.1K
opcode - 专为Claude Code设计的开源图形化桌面应用opcode是专为Claude Code设计的开源图形化桌面应用,开发者winfunc基于Tauri 2 + React 18 + Rust开发。提供可视化界面管理Claude Code项目,支持创建...最新AI资源9个月前060.1K
Gemini 3.1 Flash-Lite - Google推出的最轻量、最具性价比的模型Gemini 3.1 Flash-Lite 是 Google 发布的 Gemini 3 系列中最轻量、最具性价比的模型,主打极致速度与低成本。模型从 Gemini 3 Pro 蒸馏而来,输入价格仅 ...最新AI资源6个月前060.1K
LLaVA-OneVision-1.5 - 免费开源的多模态模型,高性能多模态理解LLaVA-OneVision-1.5是EvolvingLMMS-Lab团队开源的多模态模型,采用8B参数规模,通过紧凑三阶段训练流程(语言-图像对齐、概念均衡与知识注入、指令微调)在128张A800...最新AI资源11个月前059.9K
NocoBase - 免费开源的AI无代码开发平台,可视化构建应用NocoBase是基于AI驱动的开源无代码开发平台,支持快速搭建业务系统,无需编程即可通过配置完成应用开发。项目采用Apache-2.0协议,提供私有化部署和灵活扩展能力,适用于企业管理、协作平台等场...最新AI资源10个月前059.9K
HY-WU - 腾讯混元开源的实时神经参数生成框架HY-WU(混元无相)是腾讯混元推出的功能性神经记忆框架,能在AI推理时即时创建个性化适配参数。框架为每个任务"临时定制"专属技能,无需重新训练模型。最新AI资源6个月前059.7K
GLM-5.2 - 智谱最新推出的旗舰级开源大模型GLM-5.2 是智谱最新推出的旗舰级开源大模型,超长上下文理解和智能编程为核心卖点。模型具备百万级 token 的上下文处理能力,能一次性分析整个代码仓库或长篇技术文档。最新AI资源3个月前059.7K
OmniVinci - NVIDIA开源的全模态大语言模型OmniVinci 是 NVIDIA 开发的开源全模态大型语言模型,通过架构革新和数据优化解决多模态模型中的模态割裂问题。通过 OmniAlignNet 加强视觉和音频嵌入的对齐,利用时间嵌入分组捕捉...最新AI资源11个月前059.7K
TalkCody - 免费开源的AI编程桌面助手,支持复杂任务TalkCody是免费开源的AI编程助手桌面应用,基于Rust + Tauri 2构建,支持Windows、macOS和Linux三大平台,具有原生性能、快速启动和低资源占用的优势。支持50多种主流A...最新AI资源10个月前059.7K
Cosmos 3 - NVIDIA 开源的物理 AI 全模态模型Cosmos 3 是 NVIDIA 开源的首个完全开放的物理 AI 全模态模型,采用创新的 Mixture-of-Transformers(MoT)架构,将视觉推理、物理世界生成与动作预测统一在单一系...最新AI资源4个月前059.5K
LazyCraft - 开源AI Agent应用开发与管理平台,基于LazyLLM构建LazyCraft 是商汤基于开源框架 LazyLLM 构建的开源 AI Agent 应用开发与管理平台,为企业和开发者提供一站式AI应用开发解决方案。帮助开发者以低门槛、低成本快速构建和发布大模型应...最新AI资源10个月前059.4K
SAM 3D - Meta开源的3D重建模型系列SAM 3D是Meta公司推出的基于SAM系列的3D重建模型,包含SAM 3D Objects和SAM 3D Body两个分支。其中SAM 3D Objects能从单张照片生成可交互的3D物体模型,支...最新AI资源10个月前059.3K
nanochat - Karpathy免费开源的低成本模型训练项目nanochat是AI领域传奇人物、前特斯拉AI总监Andrej Karpathy发布的开源项目,以极低的成本和简单的操作,让个人能快速训练出一个类似ChatGPT的小型语言模型。整个项目仅用约800...最新AI资源11个月前059.3K
美间:在线软装(家装)设计工具,快速生成设计方案,软装辅助AI工具箱综合介绍 美间 是一个专注于家居设计和营销谈单的在线平台。该网站提供丰富的设计素材、软装和提案PPT模板、海报模板等,帮助设计师和业主快速生成高质量的设计方案。美间的在线软装设计工具可以在短短10秒内...最新AI资源# AI图像编辑# AI生成演示文稿/PPT1年前059.2K
Aholo Viewer - 群核科技开源的3D高斯浏览器Aholo Viewer是群核科技开源的3D高斯浏览器,支持在普通设备浏览器中流畅渲染10亿级高斯点的超大3D场景。核心技术采用chunk-based LOD树架构,相比李飞飞团队的Spark 2.0...最新AI资源4个月前059.1K
Depth Anything 3 - 字节跳动Seed开源的3D视觉重建模型Depth Anything 3(DA3)是字节跳动Seed团队研发开源的3D视觉重建模型。通过单一Transformer架构实现任意视角下的空间几何重建,仅需预测深度图和射线图即可还原三维场景,相比...最新AI资源10个月前059.1K
LLaSO - 逻辑智能推出的业界首个全面开源的语音模型LLaSO是北京深度逻辑智能科技有限公司推出的开源语音模型,通过整合语音与文本数据,提供对齐数据集、指令微调数据集和评估基准,解决了大型语音语言模型领域数据分散、任务覆盖不足等问题。最新AI资源1年前059K
HunyuanVideo 1.5 - 腾讯混元免费开源的轻量级视频生成模型HunyuanVideo 1.5 是腾讯混元大模型团队开源的轻量级视频生成模型,基于 Diffusion Transformer(DiT)架构,参数量为 8.3B。支持生成 5-10 秒的高清视频,分...最新AI资源10个月前058.7K
Grok Build - xAI 发布的早期测试版AI编程智能体工具Grok Build是xAI发布的早期测试版AI编程智能体工具,主要面向专业软件开发者,是一个运行在终端(CLI)的编程智能体,帮助开发者完成编码、构建应用程序和自动化工作流程等任务,直接对标Anth...最新AI资源4个月前058.7K
Fara-7B - 微软开源的计算机操作Agent助手模型Fara-7B是微软开源发布的70亿参数规模的计算机操作代理(CUA)模型,基于Qwen2.5-VL-7B架构。通过视觉解析网页截图,在屏幕上执行点击、输入等操作,无需依赖额外的可访问性树或多个大模型...最新AI资源10个月前058.6K
Composer 2.5 - Cursor 发布的最新一代专有 AI 编码模型Composer 2.5 是 Cursor 发布的最新一代专有 AI 编码模型,基于月之暗面(Moonshot AI)开源的 Kimi K2.5 检查点构建,通过更大规模的强化学习与合成数据训练,在长...最新AI资源4个月前058.6K
Hy-MT2 - 腾讯混元开源的多语言机器翻译模型家族Hy-MT2 是腾讯混元开源的多语言机器翻译模型家族,专为复杂真实场景设计。包含 1.8B、7B 和 30B-A3B(MoE) 三个尺寸,均支持 33种语言 之间的互译,具备多语言翻译指令遵循能力。最新AI资源4个月前058.6K
Frappe Builder - 开源的AI低代码网站构建工具,拖拽组件快速搭建Frappe Builder是开源的低代码建站工具,由Frappe公司开发,核心特点是提供类似Figma的可视化编辑器,支持拖拽组件快速搭建网站。属于Frappe生态(Frappeverse)的一部分...最新AI资源10个月前058.5K
Qwen3.5-LiveTranslate - 阿里通义千问发布的实时语音翻译大模型Qwen3.5-LiveTranslate 是阿里巴巴通义千问团队发布的实时语音翻译大模型,基于 Qwen3.5-Omni Thinker-Talker 架构打造。模型支持 60 种语言的音频输入与文...最新AI资源4个月前058.5K
Uni-1.1 - Luma AI推出的图像生成模型Uni-1.1是Luma AI推出的图像生成模型,将文本理解与图像生成整合进同一个 decoder-only、autoregressive 模型中,非像主流方案那样把语言模型和图像模型拼接使用。最新AI资源4个月前058.4K