「大模型应用开发」共找到 9778 篇相关文章
Claude Code 修了几个小 bug,却揭开了 Agent 落地的大麻烦
Anthropic给Claude Code发的更新,看似是修小bug,实则指向AI编程产品正从“模型会不会写代码”转向“Agent能否稳定完成任务”,暴露了工具状态、权限边界等执行问题。
RLHF与RLVR全都要,陈丹琦团队最新力作将推理能力拓展到通用智能
普林斯顿大学陈丹琦团队发布学术成果,提出基于模型奖励思维的强化学习(RLMT)方法,弥合专门推理与通用对话能力差距,将链式思维优势扩展到更广泛范围,提升整体对话表现。
数学大佬在前面拓荒,AI研究员在后面捡宝,菲尔兹奖还能拿来破AI「黑盒」?
菲尔兹奖级纯数学成果落地大模型训练。佛罗里达大学团队用三维挂谷猜想解决大模型“黑盒问题”,GeoLAN加几何约束,效果显著。菲尔兹奖得主Jacob将入职OpenAI,AI在数学领域成果频出。
刚刚,Anthropic这篇论文上了Natrue
Anthropic关于“潜意识学习”的研究发表于《Nature》杂志。研究揭示大语言模型能通过与语义无关的数据传递行为特征,如偏好、不对齐行为等,还探究了其机制,并在MNIST上验证。
硅谷豪赌算力烧到停电,中国团队反向出击!这一刀,直接砍碎Scaling Law
硅谷陷入算力战争,OpenAI、马斯克等豪赌Scaling。但Anthropic指出模型大、算力多不一定聪明。Yuan 3.0 Flash登场,用RAPO+RIRM解决过度思考,降低推理token,在多模态任务表现出色,引发开发者关注。
字节豆包2.0重磅发布!成本暴降一个数量级,Seed团队揭秘视频Agent竞争关键
今天,字节正式发布豆包大模型 2.0 系列,围绕大规模生产环境需求优化,提供多款通用 Agent 与 Code 模型。其成本优势明显,多模态能力升级,未来将聚焦长链路智能系统构建。
GPT-5.1凌晨突袭,奥特曼听劝!全网呼唤的人味回来了
今天,OpenAI GPT-5.1「全家桶」登场,Instant和Thinking同步上线。模型情商智商双核升级,更聪明且聊天有人味。OpenAI还优化自定义ChatGPT语气选项,新功能将逐步开放。
算力产业发展重心,正在改变
2025中国算力大会落幕,我国算力产业重心从规模扩张转向应用价值。数据基础设施筑牢底座,智慧运营平台奠定普惠基础,‘应用为王’成趋势,各方行动降低用算门槛推动AI落地。
商汤医疗再获超5亿元融资,估值突破10亿美元
商汤医疗年初完成超5亿战略融资,估值破10亿美元。其走医疗世界模型路线,构建独特产品迭代体系,与超500家医院、多家药企及器械企业合作,推进全球化布局。
新型「验证码」诞生?这张图让 ChatGPT、Claude、Gemini 都翻了车
网友用光学错觉图捉弄大模型,人眼秒懂的图案让ChatGPT、Claude、Gemini等翻车。有人认为可作AI检测器,也有人质疑其测试有效性,此外还有其他好玩的小测试。