「模型行为团队」共找到 9409 篇相关文章
深夜突袭!谷歌Gemini 2.5 Pro更新蝉联榜一:推理超越o3,编程超越opus4
深夜谷歌对Gemini 2.5 Pro模型重大更新,在编码、推理等测试中超越o3,几周内成稳定版。其价格优势大,还增加思考预算,输出风格和结构改进,用户实测反馈佳,但发布不久被越狱攻击。
中国科学家首次手搓出“球状闪电”!刘慈欣科幻小说照进现实
4月16日,中科院上海光机所团队在《自然·光子学》发文,首次在实验室可控生成具球状闪电典型特征的宏观电磁孤子。其存活时间长、空间尺寸大,还能为研究提供受控平台,有潜在应用价值。
让AI自己“炼数据”!DataChef开源:用强化学习自动生成LLM数据配方
上海人工智能实验室联合复旦大学开源DataChef,它能通过在线强化学习自动生成LLM数据配方。实验显示其能力逼近Gemini - 3 - Pro,超越人类专家设计算法,解决传统数据工程难题,推动大模型数据工程迈向新范式。
没KPI反而爆了?Cursor大神一人敲出核心功能!CEO上手7天不宕机,AI编程玩法全变了
昨日,Cursor的CEO基于GPT - 5.2构建了超300万行代码的浏览器,具备基础可用性。同时,Cursor工程负责人在访谈中分享了编码Agent发展、Cursor使用方式、未来方向等多方面内容,还揭秘团队工作模式。
王阳明心学,被Anthropic用来教Claude做人了
UT Austin哲学教授Harvey Lederman研究王阳明心学十年,现加入Anthropic做Claude对齐训练。他用分析哲学拆解“知行合一”,发现AI模型存在“信念冲突”,Anthropic用类似阳明心学方法解决问题。如今硅谷AI公司争抢哲学家。
刚刚,Claude Code大升级!卡帕西:LLM第三次变革
Anthropic发布企业协作工具Claude Tag,定位为Claude Code进化版,更擅团队协作。约65%产品代码由其参与完成,卡帕西称是LLM用户界面第三次变革。它能深入企业工作流,已在Slack测试。
OpenClaw危了?Claude Code迎来最激进升级:AI 开始直接操控电脑,正面挑战 OpenAI
北京时间昨日夜里,Anthropic 宣布对旗下 Claude Code 与 Claude Cowork 进行关键更新,AI 可直接操控电脑。同日 OpenClaw 也迎来重大更新,重构插件系统、升级模型等。二者更新引发关注,各有优劣。
清华AI找药登Science!一天筛选10万亿次,解决AlphaFold到药物发现的最后一公里
清华大学团队在Science发表论文,研发AI驱动的超高通量药物虚拟筛选平台DrugCLIP。它24小时能完成10万亿次蛋白–分子配对计算,打通从AlphaFold到药物发现通道,完成人类基因组规模筛选,数据已开放。
DragonMemory:16倍语义压缩,为RAG应用瘦身
介绍GitHub项目DragonMemory,它针对RAG应用上下文压缩,核心是Dragon v7模型,从序列维度压缩,压缩比达16倍。本地测试效果好,有图形界面,支持多格式文档,开源但非成熟商业产品。
MIT给微型机器人做了颗芯片,功耗仅6毫瓦,能实时3D建图
麻省理工学院研究团队开发出名为 Gleanmer 的微型芯片,功耗仅 6 毫瓦,能实时生成三维占据地图。它解决了机器人导航核心问题,通过多项优化提升性能,或让小设备拥有空间理解能力。