大模型自信问题」共找到 9454 篇相关文章

新闻资讯8

谷歌NotebookLM终于说中文了!这可是最火的大模型播客产品

NotebookLM正在变成谷歌AI路线里靠谱选手,现支持中文播报且将推移动App。它能将音频源转化为类似播客的对话,有摘要等功能,音频概览功能受欢迎,底层是谷歌Gemini 2.5 Flash,实用性强,即将上线安卓和iOS版App 。

机器之心
新闻资讯8

智谱定档大模型第一股,1月8日挂牌上市,IPO预募资43亿港元

智谱定档2026年1月8日在港交所主板挂牌上市,预募资43亿港元,上市后市值预计超511亿港元。它是中国最早开展LLM研发的公司,多模型表现亮眼,靠MaaS模式实现盈利,但研发投入巨大。

量子位
算法论文8

EMNLP2025 | 探究大语言模型的语言共享神经元提升低资源语言能力

论文提出BridgeX - ICL方法提升LLM低资源语言性能,通过三步实现优化。构建两类探测数据解决传统问题,识别重叠神经元,用HSIC选最优桥梁语言,在多任务实验验证其有效,揭示多语言机制规律。

深度学习自然语言处理
新闻资讯7

Next.js 真有那么好用吗?Netlify 谈他们遇到的六个现实问题

Netlify 部署大量 Next.js 网站时遇到诸多挑战。如无适配器支持、无生产级无服务器部署文档、存在未文档化行为、未基于开放 Web 标准、缺乏路线图可见性和发布可预测性等,并提出应对办法与展望。

InfoQ
新闻资讯7

Mythos限测首日破防,论坛玩家猜网址就摸进门了

4月7日,Anthropic新模型Claude Mythos Preview限量发布,当天就有未授权用户猜出在线地址获得访问权限。Anthropic称未发现自身系统受影响,该模型对齐表现较好,但训练有技术错误。

新智元
算法论文7

DeepSeek-OCR是「长文本理解」未来方向?中科院新基准VTCBench给出答案

DeepSeek - OCR的VTC技术可实现高压缩率,降低长文本处理成本。但视觉语言模型能否理解压缩信息存疑,中科院等推出VTCBench评估,测试模型认知极限,还推出VTCBench - Wild检测鲁棒性。

机器之心
新闻资讯8

加入Meta近一年,亚历山大王回应:超级智能之前,AI终局未定

亚历山大·王加入Meta近一年后携Muse Spark模型回归,回应诸多争议。他指出Llama 4发展不符要求,Meta缺超级智能信仰。介绍了Meta超级智能实验室架构原则,还谈到算力分层、模型福利等内容。

AIGC开放社区
产品应用8

Token烧不起了?比肩Claude Opus 4.6免费模型来了,还将开源

昆仑万维旗下天工AI发布SkyClaw - v1.0,为Agent场景深度优化,免费试用后将开源,价格低。性能超同级别开源对手,逼近闭源巨头。训练围绕环境构建、数据合成、强化学习展开,适合长链路Agent工作流。

AIGC开放社区
开源动态8

南京大学开源SteadyDancer模型实现完美动作迁移,首帧保留彻底解决身份漂移难题

南京大学、腾讯PCG与上海人工智能实验室联合推出SteadyDancer,这是首个基于Image-to-Video范式并严格实现首帧保留的开源人像动画框架,解决了传统方法身份漂移难题,在多方面表现优异。

AIGC开放社区
算法论文8

首次!AI智能体破解「纳什均衡」,大模型学会博弈论|Cell子刊

多所高校研究团队开发出PrimeNash大语言模型智能体框架,能自动推导纳什均衡闭式解析解并生成证明。它模拟人类科研路径,分三模块求解,经经典博弈验证,还在碳市场博弈展现应用潜力。

新智元