ALL HERE INDUSTRY INSIGHTS
行业咨询
来自一手发布、开源社区与论文平台的前沿动态。
MiniMax H3 开源:33B 多模态视频生成模型来了,但两个关键模块没给
MiniMax 把 H3 开源了。 Hugging Face 上,35,295 次下载,45 个微调版本,65 个 Space。模型本体是开放的,真正想用的那两样东西不在里面。 三
发布日期:
阅读全文 →Mistral 发了个 3B 的「合规守门员」,支持自然语言写策略、推理一次出分
Shieldstral-1.0-3B:Mistral 的轻量化内容审核模型 Mistral AI 最近在 Hugging Face 上线了 Shieldstral-1.0-3B,一
发布日期:
阅读全文 →Liquid AI 发了个 2.6B 小模型,声称"在 Agent 任务上吊打 4 倍体量的模型"
Liquid AI 发了个 2.6B 小模型,号称在 Agent 任务上吊打 4 倍体量的模型 LFM2.5-2.6B 最近在 Hugging Face 上线。2.69B 参数,1
发布日期:
阅读全文 →Kimi K3 开源|2.8T 参数,首张 3T 级开放权重落地
Kimi K3 开源评测:2.8T 参数与 Agentic 实战 Moonshot AI 把 Kimi K3 开源了,挂在 Hugging Face 上。总参数量 2.8T,激活参
发布日期:
阅读全文 →DeepSeek-V4-Flash-0731正式发布:Agent能力跨越,304B模型MIT开源
DeepSeek 把 DeepSeek-V4-Flash 从预览版推进到正式版了。 这个版本在 Hugging Face 上的代号是 DeepSeek-V4-Flash-0731,
发布日期:
阅读全文 →inclusionAI 发布原生混合线性模型 Ling-3.0-flash:124B 参数只激活 5.1B,专为 Agent 工作流设计
title: InclusionAI 发布 124B 混合线性推理模型,Agent 部署成本再压低 InclusionAI 发布 124B 混合线性推理模型,Agent 部署成本再
发布日期:
阅读全文 →Qwen3-VL-32B 拆成两半进 ComfyUI,INT8 编码器只要 24GB
Qwen3-VL-32B 拆成两半进 ComfyUI,INT8 编码器只要 24GB Hugging Face 上 ethanfel 发了一个 ComfyUI H3 格式的 Qwe
发布日期:
阅读全文 →CAVE 论文:视频定位模型「蒙对答案」的盲区,终于有人治了
做视频时间定位(Video Temporal Grounding)的团队,这两年基本都在用强化学习(RL)微调大视觉语言模型(LVLM)。给定一句描述,让模型从视频里找到对应的起止
发布日期:
阅读全文 →腾讯元宝搜索Agent的训练框架公开了,核心是解决那个「对齐税」问题
搜了一圈昨天的arXiv,让我停住的是这篇——腾讯元宝搜索Agent背后的训练框架正式公开了。论文标题《Cross-Domain Hybrid OPD for Generaliza
发布日期:
阅读全文 →TTS 横评 960 组音频:情感语音仍是合成最难的一关
arXiv 上周上线了一篇很扎实的 TTS 评测论文。四位研究者把四款主流语音合成系统放到四个场景里硬碰硬比了一轮,跑了 960 组音频,结论一句话就能说清楚:聊天气氛最好捏,动真
发布日期:
阅读全文 →Agent 工作流跑一半卡住?GRAFT 说不用重来,嫁接一段就行
做 Agent 工作流的人大概都遇到过:全局搜出来一个优化架构,跑起来大多时候不错,但某些输入就在特定子任务上翻车。只想修那一块,可现有的方法不允许——要改就得全局重新优化一遍,算
发布日期:
阅读全文 →Agent 做到一半,用户改了主意——这篇论文想治这个病
如果你用 Agent 干过持续半小时以上的任务,大概率遇到过这个场景:跟它说到第三步了换个思路,它礼貌接受,然后继续按旧逻辑调旧 API,反复在一个无关函数上打转,直到 token
发布日期:
阅读全文 →不重新训练,只改解码结构:PCTree 把 LLM 推理链条变树,速度涨了 3%–29%
昨天 arXiv 上挂出来一篇论文,标题叫「From Chains to Trees」,一眼就知道它想干什么——把 LLM 推理时那个逐 token 串行解码的链条,改成一种树状结
发布日期:
阅读全文 →