「测试时训练」共找到 3996 篇相关文章
当200位具身从业者被拉进同一个屋子
量子位等联合发起沙龙,近200位具身从业者探讨具身智能从实验室走进物理世界的问题。乐聚工程师指出具身数据瓶颈,蚂蚁灵波郑可成介绍模型,上海交大李永露分享评测基准,圆桌对话探讨数据挑战与破局路径。
2亿多人开始和AI打电话,他们在聊什么?
2025年12月豆包月活达2.27亿,越来越多人与它语音通话。此前AI语音交互存在问题,豆包升级为全双工模型,体验更像打电话。作者实测其在不同场景表现出色,还分享使用技巧,并对比了和ChatGPT语音的优劣。
AIAA J | 西工大翟凯宇、李楠等:膨胀拐角影响下入射激波/边界层干扰的标度律分析
高超声速进气道肩部区域的激波 - 膨胀波 - 边界层干扰影响大,传统标度律有误差。本研究结合实验与理论,研究膨胀拐角影响下的入射激波/边界层干扰,提出改进标度律,还构建混合监测框架实现准确预测。
OpenAI又曝出内讧了!IPO前夜高层大换血
OpenAI在冲刺IPO之际,高层现剧烈人事动荡,COO转岗,多位核心高管离职或休假;CEO奥特曼与CFO因IPO时间表分歧失和,奥特曼求快,CFO求稳,公司财务压力也不容小觑。
叫板华尔街之神!诺奖得主在谷歌眼皮底下组队炒股,CEO亲自叫停
AlphaGo之父Hassabis曾在谷歌眼皮底下拉20个顶尖研究员训练高频交易AI,想挑战华尔街量化之神,与贝莱德探讨合作。后因谷歌CEO叫停,项目停摆。不过如今AI+金融正加速发展。
最强Claude模型提前曝光!附带Anthropic三千份保密档案在线裸奔
向来标榜安全的Claude因权限配置失误,新模型Mythos提前曝光,还泄露3000份保密档案。Mythos比Opus 4.6更强,公司虽在测试但因安全风险限制发布,也有人质疑信息真实性。
Claude最新模型Mythos意外泄露,性能远超Opus
Anthropic内容管理系统配置失误,近3000个未发布资产泄露,Claude最新模型Mythos提前公开。它在软件编码、学术推理和网络安全等测试中远超Opus,网络安全能力尤其危险。2026年初Anthropic产品密集发布。
好看不等于会交互!阿里发布基于交互的世界模型基准
阿里等联合推出 Omni - WorldBench 评估框架,指出多数高颜值 AI 视频在物理规律和交互逻辑上有缺陷。该框架含提示词套件和量化评估框架,对 18 款模型测评,为 4D 世界模型研发指明方向。
手残党跪了,Pi 0.6机器人15分钟学会拧螺丝,能进厂边干边学了
具身智能领域 Physical Intelligence 公布新进展,借助「RL token」法,让机器人短时间掌握精细操作。该方法给 VLA 加「外挂」,使机器人进化快、学习效率高,在多项任务测试中表现出色。
Claude Code也要龙虾化!凌晨床上发条消息,Mac Mini瞬间亮屏狂敲代码
Claude Code团队宣布新增Channels功能,可通过MCP控制会话,首批支持Telegram和Discord。用户能手机远程控制AI写代码,目前已灰度测试。不过其功能依赖会话存活,后续或接入更多平台。