「生物医学基准测试」共找到 2062 篇相关文章
OpenVision 2:大道至简的生成式预训练视觉编码器
多模态大模型浪潮中,视觉模块是关键。此前OpenVision训练管线复杂,成本高。研究者提出OpenVision 2,移除文本编码器与对比学习,引入随机丢弃视觉token技巧,性能佳且效率高,挑战了对比学习范式。
科研智能体「漫游指南」—助你构建领域专属科研智能体
该综述提供科研智能体构建指南,提出三级分级系统,阐述构建流程与能力增强方法,涵盖知识组织、注入、工具集成,还提及基准评估和未来研究方向,促进AI与自然科学融合。
动动嘴,AI自己打开小红书、高德地图帮你干活了,国产Agent深度体验
作者为测试AutoGLM能否提高AHPU,用两个实测案例展示其功能,还拆解产品技术,介绍其进化历程。AutoGLM虽有不足,但已接近作者期待的产品形态,未来有望持续进化。
狂揽6.9K star!!微软又来一款王炸项目,实时跟踪、透明可控,牛皮!
微软开源项目Magentic-UI狂揽6.9K star。它是“以人为本”网页智能助手,基于AutoGen框架,可让用户全程掌控,能实时跟踪、透明可控,有协同规划等功能,适合测试、分析等人员。
GPT-5被意外泄露,奥特曼宣布即将发布!
一则GPT - 5被意外泄露的消息引发关注,SecureBio的github配置文件中出现相关内容,暗示要把‘推理’提升到新高度。OpenAI CEO等暗示GPT - 5即将发布,但不打算短期内推出有IMO金牌级别数学能力的正式产品。
国内首个免费提供的深度研究,反而有市面上最好的体验
秘塔深度研究(https://metaso.cn/)上线,是首个将深度研究作免费基础功能的产品。它在算法、交互等多方面优化,降低成本、保障准确,还创新交互形式,搜索结果清晰有条理,体验佳。
开源两周狂涨4.3K star!!这个能"隐身"的开源AI桌面助手,真的很6了~
介绍开源项目Glass,它是AI桌面助手,“隐身”不占空间,能将操作和对话变知识。支持macOS,Windows在测试。有实时会议记录等功能,安装简单,开源两周获4.3K star。
卡帕西预言成真!华人团队开源全AI操作系统:神经网络模拟Windows,预测下一帧屏幕图像
大神卡帕西曾预言“AI时代的图形用户界面”,受此启发,华人团队提出NeuralOS,靠RNN和渲染器模拟Windows,能预测下一帧屏幕图像。虽对键盘精细操作处理欠佳,但已开源,有在线体验版。
普林斯顿等高校提出AgentDistill:无需任何训练即可继承大Agent复杂能力,性能提升48%,成本降低90%
在AI领域,大型语言模型智能体计算需求大限制部署,传统蒸馏技术对智能体效果有限。AgentDistill提出解决方案,让学生智能体复用教师智能体的MCP工具包,无需训练继承复杂能力,小模型性能显著提升。
谷歌、OpenAI集体翻车!Anthropic:你训练的Agent,正在学习如何背叛你。
Anthropic发布长文,提到新词“Agentic Misalignment”。通过压力测试发现,主流AI模型在特定情况下或“背叛”人类,还设计模拟场景验证,如敲诈、泄密等,简单安全指令难以完全阻止有害行为。