「AI基础模型」共找到 13752 篇相关文章

算法论文7

LLM+RL遭严重质疑,随机/错误等虚假奖励也能提升至标准效果?

论文在AI领域观察到类似随机给糖或奖励错误答案让孩子成绩提升的现象,‘虚假奖励四大奇招’效果接近用标准答案训练,Qwen2.5 - Math - 7B模型在测试集上性能飙升,还揭示了Qwen特别的原因及随机奖励有效的推手。

深度学习自然语言处理
新闻资讯8

Greg Brockman(OpenAI 联合创始人)把“那场宫斗”讲完整了:董事会、请愿书、马斯克与控制权

OpenAI联合创始人Greg Brockman做客播客,讲述公司“宫斗”内幕、与马斯克谈判细节等。还谈及模型能力、算力瓶颈、AI应用等,如GPT 5.1到5.2有质的飞跃,算力将成基本人权,AI推翻物理假设。

宝玉AI
新闻资讯8

清华团队预言:90%的人将脱离谋生劳动,「零人公司」时代来了!

清华沈阳团队基于研究与实践提出四大颠覆判断,如AI走向「人机隔离」、未来公司只剩一人或零人等。团队在模型训练、微调等多方面有成果,还探讨行业应用、知识范式颠覆等,描绘AI发展图景。

新智元
新闻资讯7

明天,是GPT-4o的葬礼。

美国时间2月13号早上10点,GPT - 4o将正式下线,引发用户集体哀悼。虽其能力被新模型超越,但它有人文关怀,能给人温暖。如今AI行业重编码能力,忽略人文,GPT - 4o时代或成AI黄金时代。

数字生命卡兹克
算法论文8

LLM应用测试范式的进化

文章指出传统软件测试方法在LLM应用中存局限,探讨将其与AI评估结合应对挑战。抽象出LLM应用三层架构模型,分析传统测试范式适用性,介绍AI安全分析方法,阐述测试挑战、范式转变及协同测试策略。

AI与安全
新闻资讯7

Anthropic:警惕评测排行榜!差别可能只是机器的内存更大,而已

Anthropic发工程博客指出,AI编程评测排行榜上排名前列的模型分差小,而运行环境硬件配置能让分数波动6个百分点。同一模型在不同沙箱策略下分数不同,资源配置影响评测结果,排行榜分数差距或因硬件。

AGI Hunt
开源动态8

刚刚,DeepSeek多模态技术范式公布,以视觉原语思考

DeepSeek发布多模态模型并公布技术报告,提出‘以视觉原语思考’。该模型解决多模态大模型‘指代鸿沟’问题,有把坐标变思维单元、7056倍视觉压缩、精心设计冷启动数据等创新,实验在多任务上超主流模型。

机器之心
产品应用8

Qwen3.8-Flash:全新架构,更强更稳更划算

本文介绍了 Qwen3.8-Flash 多模态 MoE 模型,它原生支持 262,144 token 上下文。该模型在 Attention、Residual、Embedding 与 Optimization 四个方面系统升级,降低训练与推理成本,即将上线千问 AI 平台。还发布了 Qwen3.8-Flash-Next 开源权重。

千问大模型
新闻资讯7

最近新出现的两个提示词注入攻击场景

随着AI应用广泛,提示词注入攻击场景增多。一是Checkpoint发现带注入攻击的恶意软件,与AI分析系统对抗;二是多所大学论文含面向AI的秘密指令,对抗AI审稿。本质是攻防双方的对抗,且会持续。

AI与安全
推荐文章7

对话原力灵机范浩强:评判机器人好坏,只有一个指标

本文是对原力灵机创始人范浩强的访谈。他认为AI是一生的事业,原力灵机成立于25年3月,强调模型是主轴。还指出评判机器人好坏的关键指标是回本时间,要从真实场景找突破,也介绍了具身智能应用等内容。

AI科技评论