传统软件测试」共找到 3187 篇相关文章

算法论文8

MIT新研究:大模型加噪声就能替代GRPO/PPO调参

MIT新论文提出,预训练模型周围存在大量“专家模型”,只需添加高斯噪声并集成,性能就能比肩甚至超越GRPO/PPO等调参算法。由此启发了RandOpt算法,经测试准确率不错,但也有依赖预训练等缺点。

量子位
新闻资讯8

OpenClaw 创始人万字访谈:一小时原型,18 万 Stars,Mark 和 Sam 抢人

Lex Fridman对话OpenClaw创始人Peter Steinberger,涉及一小时原型诞生、GitHub爆火、改名风波、Meta和OpenAI抢人等内容。OpenClaw作为开源AI Agent,能自修改软件,Peter认为80%的App将消亡,AI虽冲击编程但不会完全取代人类。

AGI Hunt
开源动态8

万亿思考模型夺下IMO金牌,无缝接入OpenClaw!一句话手搓丐版PS

2026年AI圈竞争激烈,闭源巨头巅峰对决时,开源社区迎来中国队的「技术核爆」。全球首个万亿级混合线性「思考模型」Ring - 2.5 - 1T开源,它能力强大,还能无缝接入Claude Code,实战表现亮眼。

新智元
开源动态8

GLM-5真够顶的:超24小时自己跑代码,700次工具调用、800次切上下文!

GLM - 5正式发布,把开源AI带入长任务时代。它超24小时自己跑代码,完成GBA模拟器,能力稳定。评测结果佳,在主流测试中编程能力与Claude Opus 4.5对齐,引发网友欢呼。实测还展现多种应用能力。

量子位
算法论文8

何恺明带大二本科生颠覆扩散图像生成:扔掉多步采样和潜空间,一步像素直出

何恺明团队提出新方法Pixel Mean Flow(pMF),突破传统扩散模型/流模型限制,砍掉多步采样和潜空间,一步在像素空间生成图像,在ImageNet不同分辨率上取得佳成绩,还介绍了核心设计、实验结果对比等。

量子位
推荐文章8

OpenClaw🦞 Peter Steinberger 专访杂谈

本文是对开源项目OpenClaw创造者Peter Steinberger的专访。他曾创业成功后休息三年,回归后投身AI。他分享了对AI开发、传统开发流程等看法,还预言大量App将消失,给新人程序员和焦虑者提了建议。

AIGC开放社区
产品应用8

生产级Prompt自动化推理评估A/B实验结果的工程实践

本文围绕生产级Prompt自动化推理评估A/B实验结果展开,介绍系统背景与痛点,展示主Prompt和决策树,用deepseek - r1等模型推理。通过分析Bad Cases优化Prompt,总结设计原则和迭代方法,还给出通用启示与展望。

阿里云开发者
新闻资讯7

元宝派、文心、UC…为什么BAT都急着给AI拉群?|甲子光年

近期,腾讯、百度、阿里等巨头纷纷推出AI群聊功能。这一产品形态源于ChatGPT测试,技术和市场因素使其受关注。AI群聊不仅是社交延伸,更能改变交互范式,或成AI时代入口,目前尚处试水阶段。

甲子光年
开源动态8

世界模型+强化学习=具身智能性能翻倍!清华&加州伯克利最新开源

具身智能发展中样本效率成瓶颈,传统无模型强化学习依赖盲目试错。清华与加州伯克利团队提出BOOM框架,通过自举循环机制解决在线规划与策略学习矛盾,实验表现卓越,为具身智能落地提供支撑。

量子位
算法论文8

十二大顶尖大模型决战华尔街与量化投资

文章解读重磅论文,该研究汇聚五家顶级AI厂商十二个大模型,在标普500指数十一大板块构建投资组合并测试。结果表明,混合智能策略是稳健收益最佳路径,未来量化投资是人机和量化模型三元融合。

AIGC开放社区