科大讯飞」共找到 5079 篇相关文章

算法论文8

AI自己给自己当网管,实现安全“顿悟时刻”,风险率直降9.6%

型推理模型有安全风险,此前监督微调泛化能力有限。SafeKey团队提出创新的SafeKey框架,发现模型信息“越狱”两核心,通过双通路安全头和查询遮蔽建模强化模型安全,实验验证其有效性。

量子位
算法论文8

两个LLM互相对线,推理能力起飞:康奈尔团队发布模型版类GAN训练法

康奈尔学团队提出面向语言模型的类GAN训练框架PasoDoble,通过对抗训练两模型提升推理能力,不依赖外部监督,在多模型实验中显著提升数学基准表现,不过在部分领域外任务有局限。

机器之心
开源动态8

联手月之暗面等开源OpenCUA:人人可造专属电脑智能体

香港学 XLANG Lab 和月之暗面等多家机构提出用于构建和扩展 CUA 的完全开源框架 OpenCUA,含注释工具、规模数据集等,还构建旗舰模型 OpenCUA - 32B,公开代码、数据和模型。

机器之心
算法论文8

张清鹏 Nature 子刊最新研究:AI 结合血液多组学,提前 15 年预测心血管疾病风险

香港学张清鹏团队基于UK Biobank数据,开展AI与血液多组学结合的研究。成果显示,引入血液多组学信息,能显著提升心血管疾病长期风险预测能力,为风险研究提供新思路。

AI科技评论
新闻资讯7

模型全员0分!谢赛宁领衔华人团队,最新编程竞赛基准出炉,题目每日更新禁止刷题

谢赛宁等人出题,让o3、Gemini - 2.5 - pro等模型全军覆没。LiveCodeBench Pro是实时基准测试,题库每日更新。此前称LLM编程超人类专家,本次测试并非如此,最好模型难题通过率也为0。

量子位
算法论文8

PRF | 宾州州立、南杨翔、张雯等:粗糙壁湍流的低维建模新范式

传统粗糙壁湍流低维建模依赖经验参数,泛化与精度不足。该研究提出新思路,将粗糙面形貌压缩到低维流形,用自动编码器和前馈神经网络建模,重构效果好、预测准,有生成与泛化性。

力学与人工智能
算法论文8

LeCun新作反杀AGI派!AI连「鸟」都搞不懂,拿什么超越人类?

图灵奖得主Yann LeCun联手斯坦福团队最新论文揭示,LLM仅在粗糙分类任务表现优秀,精细任务却失灵。研究测试30多个模型,得出三发现,指出LLM与人类在概念形成和信息处理上存在本质差异。

新智元
开源动态7

Google开源DESIGN.md。玩AI,今年最该知道的Markdown!

Google开源DESIGN.md格式规范,对用AI coding的人很实用,可约束产品UI设计。开源社区已有70+厂的DESIGN.md及自动提取的开源项目。还有汇聚厂设计规范的仓库及可自动生成的工具,或成行业标准。

探索AGI
开源动态8

真实评估!北理发布全球首个「全场景教育」基准,支持4000+情境

北京理工学高扬老师团队推出EduBench,是全球首个「全场景教育」基准,涵盖9教育场景、12个评估维度、超4000个情境。团队将数据、模型等全面开源,评估发现模型在特殊教育场景有不足,还提出多源知识蒸馏等方法。

新智元
8

倒计时3周离职!LeCun最后警告:硅谷已陷入集体幻觉

LeCun三周后将从Meta离职,在最新访谈中警告,硅谷对模型的追捧是集体幻觉,模型无法通往AGI。他认为世界模型才是正途,还分享了创业公司AMI的规划,批评了硅谷单一文化,对AGI时间线给出看法。

新智元