「AI架构优化」共找到 11221 篇相关文章
物理AI的「原生」时刻:原力灵机发布具身大模型DM0
主流‘预训练 - 后适配’范式有局限,原力灵机联合阶跃星辰提出具身原生 VLA 模型 DM0。它能统一机器人操作与导航,在 RoboChallenge 测试领先,还介绍了架构、训练方法及未来演进方向。
人脸机器人登上Science Robotics封面:用AI教会仿生人脸机器人「开口说话」
2026年1月15日,美国哥伦比亚大学工程学院研究登上《Science Robotics》封面,展示用AI让仿生人脸机器人“开口说话”技术。机器人经自监督学习,能将声音转自然唇动,有跨语言泛化能力,助其跨越“恐怖谷”。
世界最强医疗模型百川M3发布:AI医疗,奇点已至
百川智能发布并开源全球最强医疗模型Baichuan - M3,各项指标SOTA且超越人类医生平均水平。它告别机械‘背医书’,学会主动追问、排查病因,解决AI‘胡说八道’问题,准确度超GPT - 5.2 - High。
年度最强AI压轴!谷歌Gemini 3.0下周决战OpenAI,前端要下岗了
谷歌CEO疑似暗示Gemini 3.0下周登场,它或成谷歌重大转折点。其在代码编写、图片生成等方面表现出色,还能一句话生成OS、UI网页。谷歌与OpenAI竞争激烈,巴菲特重仓谷歌股票,业界看好其潜力。
LLM「拒绝回答」难题有救了!最新研究让AI学会人情世故 | COLM'25
最新研究发现模型规模和通用语言能力与处理敏感内容判断能力无直接关联,开源模型表现不错。通过提出的训练方法,在非推理和推理型模型上缓解过度拒绝问题,提升AI实用性和可靠性。
无需CUDA代码给H100加速33%-50%,Flash Attention作者新作火了
Flash Attention、Mamba作者之一Tri Dao与普林斯顿博士生提出QuACK库,用Python写,无需CUDA C++。在H100上比优化库快33%-50%,吸引英伟达、PyTorch团队关注。还给出优化torch.compile建议。
NLWeb: 让每个网站都装上一个智能的“对话引擎”
微软近日开源NLWeb项目,致力于简化网站构建对话式交互界面的过程。它利用现有网络生态,定义协议让用户或AI代理与网站交互,具有降低门槛、开放社区驱动等优势,目标是构建“AI Web”。
AI 有了“工号”,数据平台长出了手:Snowflake World Tour 上的三个变化
本文是白鲸开源CEO郭炜参加Snowflake World Tour上海站后的参会总结,提炼出三个值得关注的行业变化,洞察Agent时代数据平台的边界重构趋势。
用AI复制人脑可行!MIT论文估算500亿美元、10到25年可实现
美国麻省理工学院研究生艾萨克·弗里曼团队论文指出,大脑仿真正从梦想变为可量化工程问题。关键技术加速发展,成本降低、算力接近需求,未来或可用于医疗等领域。
Loop-ViT:让AI学会「反复思考」,3.8M参数小模型追平人类平均水平
香港科技大学等团队提出 Loop - ViT,将循环 Transformer 引入视觉推理领域。该模型参数少但性能强,3.8M 小版本追平人类平均水平,揭示视觉推理任务中‘思考时间’比‘模型大小’更重要。