「MiniMax-M2.5」共找到 3312 篇相关文章
ICLR 2026出分,审稿员怒喷「精神病」!DeepMind研究员教你绝地求生
ICLR 2026评审结果公布,投稿量近2万篇创新高,但分数滑坡,平均分从5.12跌至4.2。审稿人吐槽质量低,甚至有怒喷‘精神病’的情况。DeepMind研究员提供论文反驳指南,称同行评审像‘随机数生成器’。
AI版抖音来了
OpenAI发布Sora 2及专门APP,被称为AI版抖音。Sora 2在逼真度和物理准确性上有极大提升,APP玩法独特,让大量真实人物与虚拟场景结合。虽仅在美加开放且需邀请码,但闲鱼已有售卖。
比起让大模型写 100 万字的小说,AI 大牛们更想用 AI 拿诺贝尔奖
OpenAI前CPO Kevin Weil创业,新公司定位是“为AI模型收集科学数据”的平台,估值达7.5亿美元。AI4S赛道成为硅谷离职AI高管热门去向,正从概念叙事进入基础设施建设阶段,包括数据、模型、应用层。
告别高昂重制成本!港科大广州、快手可灵发布立体视频转换单步推理新方案
随着 3D 设备发展,人们对 3D 立体视频需求增加,但高昂制作成本成阻碍。快手可灵与港科大广州团队联合提出 StereoPilot 模型,能快速将 2D 视频转为高质量 3D 视频,还构建了 UniStereo 数据集。
视频生成比播放还快:开源VDN-H3,14秒视频11秒搞定
近期,网络出现“无限流”视频,源于MiniMax H3。OpenVDN团队开源Video Delta Net(VDN),基于MiniMax H3使视频生成速度提升75到90倍,14.4秒的768p视频11.23秒就能生成。它采用混合思路,性能提升显著。
Gemini 3.8,明日登场!
最新爆料,Gemini 3.8 Flash明日登场,谷歌已放弃Gemini 3.5 Pro。其编程实力强悍,之前还为Gemini植入智能体视频理解功能,降本提效,可应对多种高难度场景。近期多家AI发布计划撞车,混战升级。
AI看不到的爱心,成了最棒的AI检测器。
作者以漂浮爱心图检测AI,Gemini 2.5 Pro、GPT - 5等模型均失败。又用噪点鹿视频测试,AI准确率为0%。原因是AI是空间王者、时间瞎子,无“共同命运法则”视觉系统,存在时间盲视。
五倍推理加速,激发自回归潜能,苹果新工作让LLM预测未来
近年来自回归训练方法成语言模型主流范式,但推理阶段计算开销大。苹果研究人员开发框架,让预训练自回归大模型多 token 预测,代码和数学任务推理加速达 5.35 倍,一般任务约 2.5 倍。
LLM 驱动的 AI Agent通信:协议、安全风险与防御对策
论文围绕智能体通信的协议、安全风险及防御对策展开探讨。介绍兴起与重要性、定义分类、解析多种协议,分析不同交互的安全风险,提出防御对策,还以MCP和A2A为例做攻击实验,给出未来研究方向。
OpenAI单月收入突破10亿美元!算力严重不足,急需“星际之门”
OpenAI首席财务官Sarah Friar透露7月单月收入破10亿美元,因GPT - 5发布和新订阅服务,算力压力大,所以联合投资打造“星际之门”。虽GPT - 5有争议,但订阅用户增长,开发者反馈好。