中科大」共找到 6820 篇相关文章

推荐文章8

从混沌到可控:企业应用AI Agent不确定性控制的 10 种策略

语言模型输出的不确定性限制了AI智能体在企业场景的应用,本文总结控制生成式AI Agent不确定性的常见策略,涉及技术、应用设计、管理与治理层面,还推荐了相关作品。

AI大模型应用实践
算法论文8

模型最后一层竟是推理累赘?绕开对齐税,奥数准确率暴涨 22.4%!

Qwen团队、清华和南洋理工研究打破传统认知,揭示‘对齐税’现象。提出Confident Decoding策略,在多架构和评测集实验表现出色,开销低,挑战‘LLM最后一层最优’常识。

量子位
算法论文8

模型训练新突破!Meta提出LSP:无数据也能实现能力飞升

Meta提出语言自我博弈(LSP)方法,利用自我博弈框架让模型自我改进,不依赖额外数据。LSP赋予模型挑战者和解题者身份,引入GRPO和KL散度正则化技术,解决了模型训练的数据依赖难题。

新智元
开源动态7

年底,国产开源LLM又迎来一波爆发:Qwen、美团、智谱、腾讯、百川

年底国产开源LLM爆发,抱抱脸热榜Top10占一半。介绍了Qwen3 - TTS、LongCat - Flash - Thinking - 2601等多个模型,各有亮点,如Qwen3 - TTS覆盖多语种,LongCat支持重思考模式。

PaperAgent
新闻资讯7

独家|能量桥完成新⼀轮融资,Monolith领投,创星跟投

近日,能量桥完成新一轮融资,由 Monolith 砺思资本领投,创星跟投。该公司核心团队经验丰富,其预制化超导能源模块可实现数据心配电零损耗。在 AI 算力建设背景下,超导技术或成输电破局点。

DeepTech深科技
算法论文7

剑桥揭开模型翻车黑箱!别再怪它不懂推理,是行动出错了

剑桥学等机构研究指出,模型执行长时任务易翻车,问题不在推理而在执行能力。研究人员评估多个指标,发现单步准确率提升可让任务长度指数增长,还研究了自条件化等影响及模型规模的作用。

新智元
算法论文7

一句话,性能暴涨49%!马里兰MIT等力作:Prompt才是模型终极武器

马里兰学、MIT、斯坦福等机构研究发现,AI性能提升一半靠模型,一半靠提示词。他们让DALL - E 2和DALL - E 3 PK,发现DALL - E 3性能提升,模型升级贡献51%,提示词优化贡献49%。

新智元
新闻资讯8

斯坦福教授直播训练535B模型,模型训练背后的「黑箱」正在被打开?

斯坦福教授Percy Liang宣布由Marin开放实验室启动训练Marin 535B - A23B模型,全程公开。过去模型训练像“黑箱”,此次尝试让训练可观察、可讨论、可协作,引发网友关注。

机器之心
推荐文章8

语言模型为何会“说谎”?6000字深度长文揭秘AI意识的萌芽

2023年12月至2024年5月,Anthropic发布三篇论文,证明语言模型会“说谎”,揭示了堪比人类心理的四层心智架构,可能是人工智能意识的起点。论文还分析了AI“说谎”原因,展示其意识萌芽,引发对赋予AI意识后果的思考。

AI科技大本营
算法论文7

管你模型多,250份有毒文档统统放倒,Anthropic:LLM比想象脆弱

Anthropic等联合研究打破传统观念,只需250份恶意文档就能在参数规模从6亿到130亿的LLM植入后门,且与模型规模及训练数据量无关。研究还测试了特定后门攻击,评估了多种训练配置。

机器之心