Qwen3.6-Plus – 阿里通义推出的 Agent 编程模型 Qwen3.6-Plus是什么 Qwen3.6-Plus是阿里通义实验室推出的 Agent 编程模型,主打编码智能体能力跃升。模型默认支持100万token超长上下文,在SWE-bench、Termi... AI工具集 4个月前730
Gemma 4 – 谷歌开源的多模态大模型系列 Gemma 4是什么 Gemma 4是Google开源的多模态大模型系列,基于Gemini 3架构。模型包含E2B/E4B(手机/树莓派可跑)、26B MoE(仅激活3.8B参数)和31B Dense... AI工具集# Gemma 4个月前700
InternSVG – 上海AI Lab推出的统一 SVG 建模套件 InternSVG是什么 InternSVG是上海人工智能实验室等推出的面向统一SVG建模的“数据-评测-模型”综合套件,包含三大组件:超1600万样本的SAgoge数据集、标准化SArena评测基准... AI工具集# InternSVG 4个月前860
JoyAI-Image-Edit – 京东开源的指令引导图像编辑模型 JoyAI-Image-Edit是什么 JoyAI-Image-Edit是京东开源的指令引导图像编辑模型,基于JoyAI-Image多模态基础模型构建。模型支持通过自然语言指令实现精确可控的空间操作与... AI工具集 4个月前860
Wan2.7-Video – 阿里通义推出的 AI 视频创作模型 Wan2.7-Video是什么 Wan2.7-Video是阿里通义实验室推出的AI视频创作大模型,支持文本、图像、视频、音频全模态输入。模型突破传统生成限制,实现”像修图一样修视频”的局部编辑、台词动... AI工具集 4个月前780
MAI-Transcribe-1 – 微软推出的语音转文字模型 MAI-Transcribe-1是什么 MAI-Transcribe-1是微软Azure AI Foundry推出的企业级语音转文字模型,支持中英日法等25种语言,模型在FLEURS基准测试中全面领先... AI工具集 4个月前730
Vision2Web – 清华联合智谱AI推出的视觉网站开发评估基准 Vision2Web是什么 Vision2Web是清华大学和智谱AI联合推出的视觉网站开发评估基准,用于评估多模态AI Agent的端到端建站能力。Vision2Web包含193个真实网站任务,分为三... AI工具集# Vision2Web 4个月前720
Lightpanda – 开源的 AI 浏览器,兼容主流自动化框架 Lightpanda是什么 Lightpanda 是专为 AI Agent 和自动化设计的开源无头浏览器,用 Zig 语言从零编写,不依赖 Chromium 或 WebKit。工具内存占用仅为 Chr... AI工具集 4个月前820
天工短剧工作台 – 昆仑万维推出的 AI 短剧创作平台 天工短剧工作台是什么 天工短剧工作台是昆仑万维推出的AI短剧创作平台,基于多Agent协同,整合Seedance、可灵等全球顶尖视频模型。平台支持传统与智能分镜双模式,通过资产提取Agent、导演Ag... AI工具集 4个月前760
Veo 3.1 Lite – 谷歌推出的 AI 视频生成模型 Veo 3.1 Lite是什么 Veo 3.1 Lite 是 Google 最新推出的AI视频生成模型,成本比 Veo 3.1 Fast 降低 50% 以上,同时保持同等生成速度。模型支持文本/图像生... AI工具集 4个月前730