「工作未来」共找到 3118 篇相关文章
Meta再推WorldGen,简单一句话,竟「盖」出50×50米一座城
Meta推出WorldGen,可根据文本提示生成可探索的3D世界。它融合多项技术,能生成50×50米完整纹理化场景,保持风格与几何一致。虽处于研究阶段,但成果可兼容主流游戏引擎,有降本增效潜力。
OpenAI深夜双王炸!GPT-5.1 Pro紧急发布,降维打击Gemini 3
OpenAI同一天发布GPT-5.1 Pro和GPT-5.1-Codex-Max。前者向Pro订阅用户推出,主打「情商智商」双强;后者在Codex平台上线,专为「长时间、高强度」开发任务设计,采用「压缩」机制,表现出色。
解决Agent幻觉:HaluMem精准定位记忆系统的“说谎”环节!
近年来,LLM和Agent在记忆管理上存在挑战,现有评估方法无法定位幻觉来源。论文提出HaluMem评估基准,通过三大任务和两个数据集揭示记忆系统幻觉行为,为开发可靠记忆机制提供指导。
BettaFish微舆:一个多智能体舆情分析系统
BettaFish微舆可依自然语言需求抓取分析30多个主流社交媒体生成舆情报告。它将任务拆解给不同智能体,系统架构清晰,最终整合生成带时间线分析的HTML报告。项目在GitHub开源且登顶趋势榜第一。
ICCV25 Highlight|格灵深瞳RICE模型狂刷榜单,让AI「看懂」图片的每个细节
格灵深瞳公司灵感团队自研的视觉模型基座RICE(MVT v1.5)刷榜多项视觉任务,在ICCV25获Highlight荣誉。它延续MVT系列理念,提升图片内部视觉特征差异性,在多任务验证中表现优异。
自动化浏览器
Skyvern是能自动化浏览器操作的工具,底层靠大语言模型和计算机视觉。它提供简单API接口,可在大量网站自动化手动操作,替代易出错的自动化方案。介绍了其原理、使用方法、功能等。
连马桶都会看图说话了,巨头敢卖,你敢坐么?
老牌卫浴巨头科勒发布马桶相机Dekoda,599美元,拍照识别屎尿分析健康,还能区分用户。此外,Throne等公司也有相关产品。这些产品定位健康管理,不过面临信任、算法准确性等挑战。
英伟达用NIM + NV-Tesseract模型,提高芯片生产良率
芯片制造良率控制难题待解,传统方法各有局限。英伟达推出NV - Tesseract模型家族和NIM推理微服务,二者结合用于半导体晶圆厂生产,可实时发现问题、预测故障,降低成本,为制造打开新大门。
震撼!AI物理「双修」:亥姆霍兹方程嵌进生成器,伪影当场消失
抢滩6G前夜,香港科技大学(广州)等机构发布PhyRMDM框架,将物理约束与生成模型能力融合,解决传统AI构建无线电地图预测失真问题,成果被顶会ACM MM 2025接收,代码和权重已开源。
狂揽19.7K star!!神级开源自动化神器,拖拽即搞定,上千模版,太爽了!
本文介绍开源浏览器自动化扩展工具Automa,它基于Vue开发,支持Chrome和Firefox。不用写代码,通过拖拽模块搭建自动化流程,功能丰富,在GitHub星标超19.7k,适合非程序员等人群。