MiMo-V2-Flash – 小米开源的高性能语言模型 MiMo-V2-Flash是什么 MiMo-V2-Flash 是小米开源的高性能语言模型,具有3090亿总参数和150亿激活参数。专为智能体AI设计,采用混合注意力架构,结合滑动窗口注意力(SWA)和... AI工具集 6个月前730
Molmo 2 – Ai2开源的AI视频分析模型 Molmo 2是什么 Molmo 2 是艾伦人工智能研究所(Ai2)推出的开源视频分析模型,专注于视频理解、指向和追踪。模型基于 Qwen 3 和 Olmo 架构,具备强大的视频分析能力,能在视频中精... AI工具集# Molmo 6个月前680
Xiaomi MiMo Studio – 小米推出的在线AI聊天服务平台 Xiaomi MiMo Studio是什么 Xiaomi MiMo Studio 是小米推出的在线 AI 聊天服务平台,用户可以在其中体验 Xiaomi MiMo-V2-Flash 模型。平台支持深度... AI工具集# Xiaomi MiMo Studio 6个月前2370
A2UI – 谷歌开源Agent生成用户界面的声明式协议 A2UI是什么 A2UI(Agent-to-User Interface)是谷歌开源的基于Agent的接口协议,用于AI与用户界面之间的交互。A2UI通过AI生成的JSON描述,让客户端原生渲染交互界... AI工具集# A2UI 6个月前740
混元世界模型1.5 – 腾讯混元开源的实时交互式世界生成模型 混元世界模型1.5是什么 腾讯混元世界模型1.5(HY WorldPlay 1.5)是腾讯混元团队开源的实时交互式世界生成模型。用户只需输入文字或图片,模型能快速创建专属的虚拟世界,通过键盘、鼠标或手... AI工具集 6个月前650
Step-GUI – 阶跃星辰推出的AI Agent系列模型 Step-GUI是什么 Step-GUI 是阶跃星辰推出的AI Agent系列模型,包含云侧模型 Step-GUI 和端侧模型 Step-GUI Edge(原名:Gelab-Zero)。云侧模型擅长复... AI工具集 6个月前1040
SAM Audio – Meta开源的音频分割模型 SAM Audio是什么 SAM Audio是Meta开源的音频分割模型,能通过文本、视觉和时间片段等多模态提示,从复杂的音频混合中分离出特定的声音。核心技术是Perception Encoder A... AI工具集# SAM Audio 6个月前790
Gemini 3 Flash – 谷歌推出的最新AI模型,主打高速低成本 Gemini 3 Flash是什么 Gemini 3 Flash 是谷歌推出的高速、低成本的前沿智能模型。模型基于 Gemini 3 开发,性能显著提升,具备强大的推理能力和多模态理解能力。在多项基准... AI工具集# Gemini 6个月前680
Seed1.8 – 字节跳动推出的通用Agent模型 Seed1.8是什么 Seed1.8 是字节跳动推出的通用 Agent 大模型,具备强大的多模态能力,支持图文输入。模型集搜索、代码生成与 GUI 交互能力于一体,可在复杂工作流中高效完成任务。See... AI工具集 6个月前810
SHARP – 苹果开源的3D场景生成AI模型 SHARP是什么 SHARP 是苹果开源的 AI 模型,能在不到 1 秒内将单张 2D 照片转换为逼真的 3D 场景。模型通过 3D 高斯表示技术,用神经网络单次前馈传递,快速预测出场景的 3D 结构... AI工具集# SHARP 6个月前790