推理性能」共找到 3441 篇相关文章

新闻资讯7

谷歌看了都沉默:自家「黑科技」火了,但为啥研发团队一无所知?

当科技圈为‘谷歌黑魔法’兴奋时,所谓‘并行验证循环’可能是AI生成的‘赛博跳大神’。它号称超越思维链,性能提升显著,但发帖者身份存疑,无可靠源链接,其真实性遭业内质疑。

新智元
新闻资讯7

Python新版本去GIL刷屏,Karpathy 点赞敢死队,Python 之父:冷静,别神话并发

Python 3.14 正式发布,将“去 GIL”写进官方发行版,一整套能力同步上线,官方预估可带来约 3% - 5% 的性能提升。开发人员反馈速度明显提高,但 Python 之父认为去除 GIL 的重要性被高估。

InfoQ
算法论文8

港科联合港中文提出AdaCtrl,自适应可控Reasoning,可降10~90%

港科联合港中文提出AdaCtrl,解决LLM推理的过度思考、算力浪费和响应延迟问题。它有自适应和用户控制两种模式,通过两阶段训练法实现目标,实验效果好,未来或拓展到多领域。

深度学习自然语言处理
新闻资讯7

我在OpenAI修中文

OpenAI研究科学家陈博远介绍GPT Image 2官网博客花絮,分享模型训练、测试情况,还展示亲手制作的官网图片,包括中文彩蛋、漫画、杂志页等,体现模型文字渲染、视觉推理等能力。

机器之心
新闻资讯7

LeCun离职后不止创一份业!押注与大模型不同的路线,加入硅谷初创董事会

离开Meta后,Yann LeCun创立AMI,还加入Logical Intelligence任技术研究委员会主席。该公司推能量 - 推理模型,与主流大模型路线不同,其Kona模型在数独测试上表现远超大模型。

量子位
开源动态8

阿里开源SmartResume,简历解析无需手工

阿里在Hugging Face和ModelScope上开源智能简历解析系统SmartResume,能将多种格式简历转为结构化数据,分三阶段工作,性能优于基线方法,为HR和开发者提供工具。

AI工程化
开源动态8

IBM推出轻量多模态文档神器!OCR与QA超GPT-4o,识别率高达98%!

日常文档处理麻烦,现有工具或体积大、算力消耗高,或识别精度不够。IBM 开源轻量多模态文档处理模型 Granite - Docling,仅258M参数,性能超 GPT - 4o,适用于多场景。

开源星探
产品应用7

第一个用物理做计算原语的大规模生成模型Un-0来了,或将AI能耗降低1000倍?

Unconventional AI 发布首个以物理为计算原语的大规模生成模型 Un-0,由‘模拟耦合振子系统’驱动。其目标是降低 AI 能耗,在 ImageNet 64×64 上 FID 达 6.74,质量接近部分主流传统图像生成方法刚发布时水平。

机器之心
算法论文7

外国科学家从汉字中找到了设计超强材料的灵感!“天”字形材料最坚固

4月21日爱丁堡大学研究人员在《应用物理学杂志》发文,将“人”“大”“天”“夫”字形转化为超材料结构单元,经压缩实验发现汉字字形中藏力学规律,“天”字形材料性能最优。

DeepTech深科技
算法论文8

清华刘知远团队论文:最小化结构改动,短文本到长文本丝滑升级 | ICLR 2026

大语言模型发展中,上下文长度成关键瓶颈,主流架构计算开销大。清华刘知远团队提出《InfLLM-V2: Dense-Sparse Switchable Attention for Seamless Short-to-Long Adaptation》,提出可切换注意力框架,为长上下文研究提供新思路。

AI科技评论