上科大」共找到 6378 篇相关文章

开源动态8

模型陷入幻觉循环,如何用工程化给它“立规矩”?

普林斯顿和伯克利研究定义“机器胡扯”,指出模型胡扯问题。蚂蚁集团旗下蚂蚁密算在2025 WAIC提出高阶程序(HOP)框架,为模型注入规则,还开源此框架,其在多行业场景应用效果良好。

InfoQ
新闻资讯7

AI 渗透金融行业:模型如何破解风控、服务与决策难题?

在数字化与人工智能驱动下,金融行业变革深刻。InfoQ《极客有约》X AICon 直播栏目邀多位专家探讨模型赋能金融,涉及风控、服务、决策等难题,分享了模型应用场景、技术渗透、权衡可解释性与性能等观点。

InfoQ
算法论文8

推理效率狂飙60倍:DiDi-Instruct让扩散模型16步超越千步GPT

普渡学等研究者提出 DiDi-Instruct 后训练方法,可将扩散语言模型推理加速 60 倍,超越传统 GPT 模型。该方法实现推理效率与效果双提升,为语言模型落地提供新方案。

机器之心
新闻资讯8

范式跃迁:LLM + EC重构算法设计范式,华为&港城夺冠CVRP国际顶级赛事

近日,华为与港城联合团队‘OptVerse - CityU’在CVRPLib BKS全球挑战赛夺冠。他们用‘模型(LLM)+进化计算(EC)’架构,刷新98个历史最优解,51个设新纪录,验证AI在算法设计潜能。

机器之心
新闻资讯8

陶哲轩敲警钟!谷歌DeepMind联手五神殿,用AI向世纪难题宣战

谷歌DeepMind发起「AI赋能数学计划」,集结五顶尖机构,用最强数学AI探索数学难题。陶哲轩警示要警惕AI滥用风险,还提出论文使用AI的三建议,如声明使用、讨论风险及明确责任。

新智元
新闻资讯7

Show me《指环王》!卡帕西强推模型评测新基准

神卡帕西宣称Anthropic用《指环王》给模型评测强度,这一‘指环王基准’正接替‘鹈鹕骑自行车’SVG测试。虽Opus 5生成的画面粗糙,但网友测试展现出丰富创意,不过新测试也引发争议。

量子位
产品应用7

我让10个模型又参加了完整版数学高考,第一名居然是它。。。

作者让10个模型参加完整版数学高考,单独制定规则,邀朋友协助测试。结果令人意外,单选题第6题成噩梦,多模态题模型几乎全军覆没。讯飞星火和豆包145分并列第一,Qwen3屈居第三。

数字生命卡兹克
新闻资讯8

中国AGI深度时刻!杨强、唐杰、林俊旸、姚顺雨咖们2026开年重磅交锋

2025年中国开源模型表现出色,AI模型探索新范式。AGI - Next前沿峰会嘉宾探讨AGI发展,指出模型To C与To B市场逻辑分化,还谈及自主进化、智能体变革及中国AI发展路径等问题。

AIGC开放社区
算法论文8

伯克利联手“拷问”模型:最强Agent也才40分!新基准专治“不听话”的AI分析师

与伯克利团队推出IDA - Bench新基准,模拟真实数据分析场景,解决现有基准无法评估模型在动态交互中可靠性的问题。测试显示,顶尖模型成功率最高仅40%,不同模型还暴露多种问题。

量子位
产品应用7

QQ音乐你变了,竟能免费在AI PC原创一首《东北》

QQ音乐在AI PC可免费AI作歌,只需输入灵感,几分钟就能创作出原创歌曲。AI PC改变应用生态,降低创作门槛,更安全自由。背后是英特尔酷睿Ultra处理器革新架构,还发起加速计划。

量子位