多模型适配」共找到 9821 篇相关文章

开源动态8

8B硬刚72B!MiniCPM-V 4.5技术报告正式出炉

行业首个具备“高刷”视频理解能力的模态模型MiniCPM-V 4.5技术报告发布,提出三项关键技术,使模型任务达同级SOTA,8B参数规模超72B模型,推理快,开源后获社区好评。

量子位
新闻资讯7

谷歌神秘模型Kingfall泄漏!

近日,谷歌AI模型Kingfall在AI Studio平台短暂开放后意外曝光。它具备模态处理能力,上下文窗口6.5万个token,有两种模式。生成SVG矢量图能力超Claude 4,身份猜测不断。

AI工程化
算法论文8

必须得让AI明白,有些不该碰的东西别碰(doge)

近期类o3模型在视觉推理任务表现优异,但陷入‘盲目用工具’状态。港中文MMLab等团队提出AdaTooler-V模型,具备自适应工具使用能力,还引入指标、算法,构建数据集,在基准测评中优势明显。

量子位
新闻资讯7

The Batch: 852 | 加州重新制定人工智能监管框架

加州人工智能前沿模型联合政策工作组发布《加州前沿人工智能政策报告》,为立法者提供监管尖端AI模型的政策原则。报告聚焦前沿模型监管,提出综合源证据、鼓励信息披露等结论,还探讨了美国AI监管现状。

DeeplearningAI
新闻资讯7

Claude还是最强,但Anthropic这周好像疯了

Anthropic状告阿里蒸馏模型致其股价创新低。一位87年创业者用AI搭工作流,起初用DeepSeek和Qwen问题,换Claude后流程顺畅。MRCR v2测试显示国产模型与Claude有差距,便宜与省心模型该怎么选成问题。

探索AGI
算法论文8

大语言模型逻辑评估

现有归因问答评估方法有‘归因短视’问题,研究团队提出 LOGICSCORE 框架,从三维度量化推理质量。在数据集测试款 LLM,发现专有、开源模型等存在不同逻辑问题,还分析典型逻辑错误。

深度学习自然语言处理
开源动态8

1B参数,0.21秒识别,0.3%错字率:混元OCR拿下7项SOTA

腾讯开源模型 HunyuanOCR 在权威榜单 OmniDocBench 上霸榜,虽仅 1B 参数,却在 7 项任务击败众模型。它解决传统 OCR 流水线及通用大模型痛点,通过独特架构和训练方法实现高效准确识别。

CourseAI
算法论文8

离职特斯拉“隐身”14个月,杨硕创业终于亮牌:重新定义机器人训练范式

杨硕从特斯拉擎天柱团队离职创业一年后,妙动科技团队带来新论文《DiT4DiT: Jointly Modeling Video Dynamics and Actions for Generalizable Robot Control》。该团队用视频训练机器人动作,提出DiT4DiT模型,解决VLA模型不懂物理问题,在人形机器人上有新突破。

量子位
新闻资讯8

腾讯出手了!彻底入局Agent

腾讯云入局智能体赛道,将大模型知识引擎升级为智能体开发平台。该平台亮点,如可一键发布到企业微信,具备工具调用、Agent协作能力,工作流有全局视野Agent节点,还有Excel检索增强功能,经测试表现出色。

开源星探
推荐文章7

AI 味的原因找到了,都是 NTJ 惹的祸

作者因常被说说话像AI,好奇大模型MBTI类型。实验发现Claude - 4、Gemini - 2.5 - pro、GPT - 4为INTJ,DeepSeek是ENTJ。分析了大模型呈现NTJ特质的原因、AI味根源,还给出让大模型有情感的思路和使用技巧。

特工宇宙