「能碳产业大模型」共找到 10527 篇相关文章
手机操控革命!开源手机AI Agent,自然语言操控Android/iOS!
传统移动设备自动化工具难实现自然语言控制和跨应用交互,开源项目Mobile - Use提供解决方案。它由Minitap AI开发,能通过自然语言指令实现设备UI感知自动化,功能丰富,应用场景广。
UCSD首个智能体浏览器发布!多页面设计,颠覆传统交互
加州大学圣地亚哥分校推出Orca浏览器,把网页视为可塑材料,浏览器变为可塑空间。用户能在无限画布中浏览、管理网页,调度智能体完成任务,还可进行大规模查看、管理等操作,项目将开源。
只会「氛围编程」,永远成不了真正工程师!还差这几个关键环节
火遍全网的「氛围编程」(Vibe Coding)让编程门槛降低,但与专业软件工程师仍有差距。文章解析了差距所在,如AI编程需精确指令,软件工程复杂,对程序员「品味」要求变高,还探讨了编程未来及Vibe Coding的挑战。
EMNLP2025 | 揭开LLM训练数据中的中文污染真相,有比“您好”高2.6倍的token?
近年来,大型语言模型虽成功,但训练数据易混入不良内容。论文《Speculating LLMs' Chinese Training Data Pollution from Their Tokens》探索此问题,定义PoC Token,开发PoCDetect和PoCTrace工具,揭示LLMs训练数据污染情况。
一帮人All in AI,让搞体育的先赚到钱了
港股运动科技第一股Keep今年2月决定“All in AI”,近日发布财报宣布扭亏为盈,实现经调整净利润1035万元。这不仅是降本增效的结果,也意味着Keep在资本市场的身份发生了变化,成为全民AI应用的候选者。
We-Math 2.0:全新多模态数学推理数据集 × 首个综合数学知识体系
北京邮电大学、腾讯微信、清华大学团队提出We - Math 2.0,含知识体系、数据集及训练策略,可提升模型数学推理泛化能力。该成果在X上获关注,登Huggingface Paper日榜第一。
字节Seed提出M3-Agent:像我们一样"记住"与"思考"的长视频理解新范式
字节Seed提出M3 - Agent,这是首个融合实时视听输入、类人记忆构建与自主推理的多模态智能体。它模仿人类记忆机制,解决长视频理解痛点,已被CVPR 2025收录并开源代码,为通用人工智能奠定基础。
两周干成一天!毕马威用100页Prompt落地企业Agent
毕马威打造税务AI助手TaxBot,将两周的专业咨询工作缩至一天,效率提升超10倍。其构建KPMG Workbench平台,集成多模型,用100页Prompt指导学习,未来或采用Agent Runtime服务。
斯坦福AI虚拟实验室炸场了!几天设计92种纳米抗体,90%以上实验可行,这才是真正的AI科学家!
斯坦福大学和Chan Zuckerberg Biohub团队开发AI驱动的“虚拟实验室”,能自主研发COVID - 19纳米抗体,90%以上候选药物实验可行。AI在药物研发各环节优势显著,国内AI制药也有进展。
ICCV 2025 | ECD:高质量合成图表数据集,提升开源MLLM图表理解能力
科研等领域图表是信息核心载体,先进开源MLLMs在高难度图表理解测试准确率低。本文提出ECD数据集,规模大、质量高、风格多样,还设计合成流水线与评测基准ECDBench,为开源MLLM提供支持。