HunyuanOCR
—轻量级全方位OCR解决方案,支持100多种语言
HunyuanOCR是一款具有10亿参数的多模态语言模型,提供领先的光学字符识别(OCR)技术,能够高效处理检测、识别、复杂多语言文档解析、开放领域信息提取、视频字幕提取、图片翻译及文档问答。它支持一次推理,覆盖100多种语言。



提供通用能力的大规模预训练语言或多模态模型,是众多AI应用的基础,开发者可以通过API调用其强大的文本理解、生成和对话能力。
轻量级全方位OCR解决方案,支持100多种语言
HunyuanOCR是一款具有10亿参数的多模态语言模型,提供领先的光学字符识别(OCR)技术,能够高效处理检测、识别、复杂多语言文档解析、开放领域信息提取、视频字幕提取、图片翻译及文档问答。它支持一次推理,覆盖100多种语言。



国际数学奥林匹克金牌水平的推理,完全开放。
DeepSeekMath-V2是一款全新的开源模型,专注于数学推理。它引入了一种自我验证机制,模型既是生成者也是验证者,能够自我完善证明。该模型在2025年国际数学奥林匹克中获得金牌评分,并在2024年普特南竞赛中取得近乎完美的118/120分。



前沿视觉智能,4MP清晰画质
FLUX.2是Black Forest Labs推出的下一代图像模型。它支持多重参考功能(可同时处理多达10张图片),提供4MP编辑能力,展现卓越的真实感。该产品分为专业版、灵活版和开放权重开发版,旨在满足真实生产工作流程的需求。



SOTA开源模型,数据追踪无忧
AI2旗下的Olmo 3系列模型是开源社区的强大助力,不仅提供先进的开源模型,还确保整个模型流程和训练数据的完整追踪。



编程、智能助手和电脑使用的最佳选择
Claude Opus 4.5 智能、高效,是全球领先的编程和智能助手模型。它在深度研究、处理幻灯片和电子表格等日常任务中表现更为卓越。Opus 4.5 标志着人工智能系统能力的重大进步,预示着工作方式即将迎来更大的变革。



小成本实现强大推理能力的1.5B语言模型
VibeThinker-1.5B是一款拥有15亿参数的紧凑型语言模型,仅需$7,800的训练费用。它能提供与更大模型(如GPT OSS-20B Medium)相媲美的推理表现,同时保持小巧、高效,且易于部署,非常适合研究、初创企业和边缘计算应用。



用多种方式让你的创意焕发灵感
我们最智能的模型,助你实现任何创意。



对话人工智能的新标准
Grok 4.1 是来自 xAI 的最新一代模型,在 LMArena 排行榜上名列第一。它在情感智能、创造性写作和实用性方面实现了巨大的突破,同时相比于以往的模型,虚假信息的出现概率降低了 3 倍。



畅享顶尖AI模型,快速且免费的全新体验
Nexus API 将 ChatGPT、Gemini、Qwen 等顶尖 AI 模型整合为一个简单的 REST API。您可以生成文本、图像和进行视觉分析,每天可免费使用高达 500 次,且无使用限制。支持的 SDK 包括 npm (@mvkproject/nexus) 和 PyPI (nexusai-py)。如需帮助,请访问我们的 Discord 社群(Nexus Hub) - https://discord.com/invite/C8tdHqM,或通过 email联系我们:drezus.nexus@gmail.com。详细文档请见:https://nexus.drexus.xyz/utilities/api-docs-index



开创多模态世界的前沿工具
Marble 是 World Labs 推出的首款产品,凭借我们强大的多模态世界模型,任何人只需一张图片、一段视频、一个文本提示或3D布局,便能轻松创建高保真、持久的3D世界。


