AI 大模型」共找到 13957 篇相关文章

新闻资讯7

金融智能体真的是模型落地“最后一公里”?

InfoQ《极客有约》X AICon 直播栏目邀请业内人士探讨金融 AI 大模型实践现状。指出模型融合是主要方案,智能体有应用但也有问题。还分享了评估 AI 项目的要点、智能体应用案例及未来布局方向。

InfoQ
新闻资讯8

AI 的下一个战场:端侧模型崛起

模型退烧,小模型接棒。腾讯、阿里等厂纷纷官宣小模型成果,英伟达、OpenAI 等也有相关动作。端侧模型赛道广阔,但技术含量不低,面壁智能在端侧模型探索上成果丰硕,其 MiniCPM 系列不断迭代,还在多领域落地。

AI科技评论
开源动态8

AI 领域新动向!持续思考模型CTM横空出世:AI 向生物智能迈出重要一步

Sakana AI 推出新型 AI 模型 CTM,重新引入「时间」和「神经元动态」到 AI 计算核心。它有诸多创新,在迷宫探索、图像识别等任务表现出色,虽有训练慢等不足,但为 AI 向生物智能迈进提供新思路。

AI寒武纪
新闻资讯7

对话地平线前高管牛建伟:万亿参数模型如何重塑具身智能

具身智能赛道分“VLA派”“智驾降维派”和“模型派”。地平线前高管牛建伟认为VLA是弯路,主张用分层架构,以万亿参数“空间智能模型”做脑,VA小模型执行操作,目标是做物理世界的OpenClaw。

AI科技评论
新闻资讯7

当 70% 的人将拥有智能体,谁来给 AI 建底座?澜舟科技周明:模型落地的最后一道墙是“可信 AI

4月16日澜舟科技春季沟通会,创始人周明分享智能体到数字员工演进等内容。指出AI进入落地新阶段,提出可信AI和智能体工程,展示相关技术体系、产品矩阵及行业方案,回答企业级AI现实问题。

AI科技大本营
新闻资讯7

AI时代已来,魔幻的模型投毒事件,我们怎么应对?

央视315晚会曝光针对模型的蓄意信息围猎,虚构手环经力擎系统包装成科技尖货。黑产靠此吸金,利用技术污染证据链。多方已行动,厂商需提升安全能力,消费者要保持警惕。

AIGC开放社区
新闻资讯7

先验+后验加持,模型能否 hold 住推理预测的现实「溢出」?

多数模型评估基准依赖固定数据集,难测真实推理实力。字节跳动等推出的 FutureX 动态评测基准,将重点移至动态预测能力。实验显示不同模型在不同任务表现有别,模型在现实场景运用仍待优化。

机器之心
新闻资讯7

美国AI一骑绝尘,中国平均落后7个月!Epoch AI新报告出炉

Epoch AI报告指出,中国AI模型进展平均落后美国7个月,最小4个月,最14个月。这差距本质是「开源vs闭源」差距,中国领先模型多开源,美国前沿模型均闭源。不过中国AI追赶速度稳定。

新智元
算法论文8

DeepSeek发布最新论文,5杀手锏让模型训练、推理暴涨

全球著名开源模型平台DeepSeek在huggingface发布超强开源模型V3的论文,从硬件架构和模型设计双视角探讨高效训练和推理,提出DeepSeek - MoE、多头潜在注意力等创新技术,解决内存、计算效率等难题。

AIGC开放社区
算法论文7

姚顺雨署名:模型「现学现卖」能力首次被系统评估,腾讯、复旦联手发布CL-Bench

腾讯混元团队和复旦学研究人员联手推出全新基准测试CL - Bench,系统性评估模型上下文学习能力。测试显示十前沿模型表现不佳,揭示当前模型在该能力上的普遍短板,并指出未来四个探索方向。

AI寒武纪