新能安」共找到 7864 篇相关文章

推荐文章7

拒绝强行AIGC!| 一种全实用、准确率高的Text2Sql方案

在金融、医疗等对精确性、透明度和全性要求高的领域,完全依赖大模型NL - to - SQL力易出错。本文提出基于函数调用LLM的范式,将LLM力聚焦于调用预定义功函数,提升了数据检索的准确性、透明度和可维护性。

AINLPer
开源动态8

写Verilog、调CUDA,总翻车?工业代码大模型开始学会「先想后写」了

工业代码大模型缺的往往是‘想’的力。北航联合多家单位提出的InCoder - 32B Thinking,让模型结合工业环境思考,通过ECoT从错误中学习,用ICWM提前预判结果,还自适应思考深度,且模型与代码已开源。

机器之心
算法论文8

总成本降低30倍,告别昂贵后训练,在线策略蒸馏敲开大模型后训练的未来

明星公司Thinking Machines由前OpenAI首席技术官联合创立,其研究团队提出在线策略蒸馏的LLM后训练方法。该方法结合在线策略训练与蒸馏优势,解决后训练两难困境,成本降30倍,还为持续学习和个性化打开大门。

AIGC开放社区
新闻资讯7

整个硅谷被Meta 1亿美刀年薪砸懵了!Anthropic 联创正面硬刚:团队使命比黄金贵,多少钱都挖不动

Meta为抢AI人才,给出首年超1亿美元、四年封顶3亿美元的天价Offer。但Anthropic联合创始人Benjamin Mann称,团队重使命,钱难挖人。他还警示AI或重塑就业市场,约20%岗位受影响,同时分享AI全等看法。

InfoQ
新闻资讯8

硅谷今日最热具身模型!不用后训练,看一遍就学会

北美具身初创Skild AI发布全机器人基础模型S1,主打上下文学习,看示范视频完成复杂操作。在未见过任务上成功率达66%,远高于传统方法。其发展或让开发机器人技像给ChatGPT写Prompt。

量子位
开源动态8

万亿思考模型夺下IMO金牌,无缝接入OpenClaw!一句话手搓丐版PS

2026年AI圈竞争激烈,闭源巨头巅峰对决时,开源社区迎来中国队的「技术核爆」。全球首个万亿级混合线性「思考模型」Ring - 2.5 - 1T开源,它力强大,还无缝接入Claude Code,实战表现亮眼。

新智元
新闻资讯7

元宝派、文心、UC…为什么BAT都急着给AI拉群?|甲子光年

近期,腾讯、百度、阿里等巨头纷纷推出AI群聊功。这一产品形态源于ChatGPT测试,技术和市场因素使其受关注。AI群聊不仅是社交延伸,更改变交互范式,或成AI时代入口,目前尚处试水阶段。

甲子光年
算法论文8

挖掘注意力中的运动线索:无需训练,解锁4D场景重建

香港科技大学(广州)与地平线团队提出VGGT4D,通过分析VGGT内部机制,利用注意力层运动线索,提出无需训练框架,在动态物体分割等任务表现优异,为低成本4D重建提供思路。

量子位
开源动态8

重磅!DeepSeek再开源:视觉即压缩,100个token干翻7000个

DeepSeek-OCR模型探索视觉-文本压缩边界,用少量视觉token解码出10倍以上文本信息。它在OmniDocBench基准上表现超GOT-OCR2.0,为LLM长上下文问题提供方案,还处理多类图像与近100种语言。

新智元
算法论文8

上海AI Lab提出CANON:让RLVR自主识别优质推理模式

上海AI Lab与上海交大团队提出创框架CANON,解决将人类先验知识融入RLVR训练的难题。它通过条件分组与对比机制,自适应放大有益指标变化趋势,在数学和逻辑推理任务上成果卓越,还提升推理效率。

深度学习自然语言处理