寻找最新最佳的Freemium人工智能。浏览最全面的AI数据库,每日持续更新。
最新
LongCat-2.0 是一个大规模混合专家语言模型,总参数量为 1.6 万亿,每个 token 约激活 480 亿参数。它面向长上下文推理、编程、工具使用、研究以及智能体工作流,并在发布中描述了公开模型和 API 访问方式。
该模型引入了 LongCat Sparse Attention,通过流式感知、跨层和分层索引来降低超长输
Claude Sonnet 5 是 Anthropic 的 Sonnet 系智能体模型,面向编程、推理、工具使用、知识工作以及浏览器或终端工作流。Anthropic 将其定位为一款成本更低、但在若干智能体任务上接近更大 Opus 4.8 模型性能的产品。
该模型能够制定计划、使用工具、在 Claude Code 中运行,并通过 e
Fish Audio S2 是一套富表现力的开源文本转语音模型发布,核心是 S2 Pro,即 Fish Audio 的 40 亿参数多语言语音模型。它专为自然、逼真的语音生成而构建,支持情感、风格指令、多说话人控制、语音克隆以及行内韵律控制。
S2 Pro 采用双自回归架构,其中 40 亿参数的 Slow AR 组件负责语义预测,
GPT-5.6 Sol 是 OpenAI 下一代旗舰模型的预览版,被定位为其迄今为止在编程、科学工作、网络安全和长时程智能体任务方面能力最强的模型。它与 GPT-5.6 Terra 和 Luna 一同发布预览,其中 Sol 是能力最高的层级。
该模型引入了新的最大推理强度,用于更深入的单智能体推理,以及一种使用子智能体来加速复杂工
Seed2.1 是字节跳动 Seed 面向真实生产力场景的下一代模型家族,提供 Pro 和 Turbo 两种规格。它面向通用智能体、代码工程、办公工作、研究流程、多模态理解和视频理解。
该模型家族提升了规划、文件处理、工具使用、编码、调试和验证等多步任务执行能力,也增强了知识、推理、视觉理解、空间推理、长上下文处理以及长达数小时视
Claude Fable 5 和 Claude Mythos 5 是 Anthropic 发布的前沿模型,被描述为 Mythos 级系统,其中 Fable 5 面向更广泛的一般使用场景,而 Mythos 5 则保留给可信访问计划。公告强调它们在软件工程、知识工作、视觉、科学研究以及长而复杂任务上的能力提升。
这次发布的重点是让高能
Gemini Live Translate 是 Google 基于 Gemini 提供的近实时语音翻译体验,面向自然口语对话。公告称它可通过 Google AI Studio、Google Translate 和 Google Meet 使用,重点在于流畅的语音翻译,而不只是文本字幕。
该功能为低延迟听说场景而构建,希望译后的语音
Qwen Live Translate 是 Qwen 生态系统中的实时翻译模型,专为语音或会话工作流程的实时多语言翻译而设计。它的重点是通过将特定于任务的模型设计与研究人员、开发人员或生产团队可以使用的输出相结合,使该工作流程更加实用。 Qwen Live Translate 并不是提供通用演示,而是针对具体的能力差距,为用户提供一种更可控的方式来处理
Step 3.7 Flash 是一个针对现实世界代理的高效多模式 Flash 模型,专为使用工具的代理而设计,这些代理可以理解图像、搜索网络、编排工具以及跨常见工具执行操作。它的重点是通过将特定于任务的模型设计与研究人员、开发人员或生产团队可以使用的输出相结合,使该工作流程更加实用。 Step 3.7 Flash 不是提供通用演示,而是针对具体的能力差
Qwen 3.7 是 Qwen 大型语言模型版本,专为高级推理、代理工具使用、编码、多模式工作流程和一般助理任务而设计。它的重点是通过将特定于任务的模型设计与研究人员、开发人员或生产团队可以使用的输出相结合,使该工作流程更加实用。 Qwen 3.7 不是提供通用演示,而是针对具体的能力差距,并为用户提供一种更可控的方式来处理复杂的人工智能生成或人工智能
Krea 2 是 Krea 围绕美学、风格控制和快速创意迭代构建的形象基础模型。它专为那些想要具有表现力的人工智能图像的创作者而设计,这些图像可以遵循视觉方向,而不仅仅是满足字面提示。该模型支持风格参考和情绪板,让用户可以使用一张图像或一组精选的视觉示例来指导输出。
产品注重审美理解、快速生成、可控视觉识别。风格参考让 Krea
Scenema Audio 是一种富有表现力的音频生成模型,适用于零样本语音克隆、情感语音、歌唱和表演驱动的语音合成。它的设计目的不仅是生成文字,还可以通过节奏、呼吸、笑声、叹息、情感和声音效果来进行声乐表演。该产品将语音识别与情感传递分开,因此简短干净的参考剪辑可以定义音色,同时提示控制性能。
该模型提取自 LTX 2.3,并使
LabOS 是一个面向现代实验室的 AI-XR 联合科学家平台,它将代理推理与现实世界的实验执行联系起来。它旨在通过结合多模式人工智能代理、XR 智能眼镜、实验室专用视觉语言模型和文档工作流程,帮助科学家从干实验室规划转向湿实验室行动。目标是让人工智能看到研究人员所看到的内容,推理协议状态,并实时指导或验证物理实验步骤。
该系统是
Waypoint 1.5 是 Overworld 的实时 AI 世界模型,旨在将交互式生成的世界带入日常 GPU。它专注于通过减少通常与高端生成环境相关的硬件障碍,使世界模拟变得更容易。该产品面向那些想要实时世界而不依赖昂贵的工作站规模推理的创作者、开发者和研究人员。
该系统围绕实时世界生成和运行时效率进行了优化,使用模型和渲染改
MotifVideo 是一个视频生成产品界面,显示 Motif 精选的文本到视频输出。它专为想要评估 Motif 视频模型的视觉范围、运动质量和风格行为的创作者、营销人员和团队而设计。通过展示,可以在投入工作流程之前更轻松地判断系统是否适合创意制作需求。
该产品以提示驱动的视频生成为中心,其中文本描述被转换为生成的简短剪辑。技术评
Happy Horse 是一款人工智能视频生成产品,旨在根据提示、参考图像和其他创意输入创建电影剪辑。它针对的是创作者、营销人员、代理机构和产品团队,他们需要在没有传统制作流程的情况下将想法转化为精美的短片视频。该产品专注于速度、运动质量和创意控制,因此用户可以为活动、讲故事、教育和社交媒体生成可用的视觉资产。
该工作流程以文本到
Happy Oyster是一款人工智能创意媒体产品,旨在通过基于网络的工作流程生成视觉或视频内容。它专为希望以轻量级方式创建媒体资产而无需构建完整的制作管道的用户而设计。该产品与尝试人工智能生成视觉效果的创作者、营销人员和团队相关。
公共页面公开了产品品牌,但可读的技术细节有限,因此评估应重点关注产品内部的实际生成工作流程、模型控
Wondercraft 是一家 AI 视频工作室,旨在帮助创作者和业务团队将想法、文档和脚本转化为精美的、适合业务的视频内容。该平台汇集了视频、头像、图像、语音、音乐、声音和文本的现代人工智能模型,因此用户可以从粗略的概念转变为最终的输出,而无需将一堆单独的工具拼接在一起。它的构建是为了减少制作有用内容的麻烦,同时保持工作流程对于非技术用户来说也易于理
mTrip 行程规划器是一款复杂的基于网络的旅行计划软件,专为满足全球旅行社和旅游运营商的严格需求而精心设计。该平台受到在全球 35 多个国家/地区运营的 300 多个机构的信赖,它擅长将来自不同来源的复杂预订——包括 GDS 系统、中台工具、直接 API 连接和电子邮件确认——整合到统一、专业的旅行行程中。mTrip 每年处理超过四百万次行程的管理,