「高效智能体」共找到 3916 篇相关文章
英伟达发布统一GPU开发平台DGX Cloud Lepton
英伟达发布专为开发者设计的AI平台DGX Cloud Lepton,可汇聚全球GPU计算资源,提供即时访问和无缝部署能力。它功能强大,支持多环境部署,提供统一体验,还有庞大合作网络。
用多模态LLM超越YOLOv3!强化学习突破多模态感知极限|开源
华中科技大学、北京邮电大学等多所高校研究团队共同推出纯多模态开源LLM——Perception-R1,该模型用强化学习优化视觉感知,目前论文和代码均已开源,其在视觉任务上表现出色,为后续研究提供强大baseline。
20岁了!劈柴哥发帖庆生:谷歌翻译换了4代AI,第一次有了「呼吸感」
4月28日,Google Translate满20岁,Pichai发帖纪念,回顾其技术发展,从统计模型到神经网络,再到Gemini原生语音模型,Translate不断进化,能保留语调和节奏,虽被大模型抢风头,但仍在持续进步。
打破视频推理「先看后想」惯性,实现真正的「边看边想」丨CVPR'26
现有大型视觉语言模型(VLM)在实时场景表现不佳,宁波东方理工大学沈晓宇团队提出TaYS,让VLM从“帧文交错”切换到“并行”,实现“边看边想”,在准确性和延迟上表现出色,推动VLM走向更真实应用。
本周 5 个超酷 GitHub 开源项目,实用到飞起!
本文介绍本周5个超酷GitHub开源项目。有显示苹果设备电池状态的AirBattery,开源卫星可视化平台keeptrack.space,本地图片压缩工具Pic - Smaller,跨平台端口助手Port - Killer,轻量级AI证件照工具HivisionIDPhotos。
没KPI反而爆了?Cursor大神一人敲出核心功能!CEO上手7天不宕机,AI编程玩法全变了
昨日,Cursor的CEO基于GPT - 5.2构建了超300万行代码的浏览器,具备基础可用性。同时,Cursor工程负责人在访谈中分享了编码Agent发展、Cursor使用方式、未来方向等多方面内容,还揭秘团队工作模式。
OCR 创新技术解析丨AI Insight Talk 直播预告
在数字经济下,传统 OCR 技术面临诸多挑战。12 月 4 日 20 点,AI Insight OCR 专场直播将剖析三项突破性 OCR 技术方案,还会有圆桌对谈。分享嘉宾将介绍 HunyuanOCR、PaddleOCR - VL、MinerU 等模型亮点。
Nature重磅预警:ChatGPT切走教育主权,学生大脑或将重构?
AI正以“教育革命”之名占领全球校园,如清华新生用AI助理报到,加州州立大学接入ChatGPT Edu,Google向学生免费开放Gemini。但这悄悄重写权力格局,让教育主权面临挑战,引发诸多思考。
逛完世界机器人大会,我们发现了四大趋势|甲子光年
2025世界机器人大会8月8日在北京开幕,有200余家企业参展。甲子光年总结四大趋势,如激光雷达厂商入局、人形机器人进厂、VLA模型异军突起、仿生机器人走入现实,预示机器人产业走向实战。
一个月狂揽10K star!!这款开源的 Claude Code 桌面GUI项目,牛皮了~
Claude Code是强大的AI编程工具,但命令行操作不友好。开源GUI工具Claudia是其最佳拍档,6月开源已获10K+ star。它把复杂命令行变图形界面,功能丰富,还介绍了安装使用方法。