「人类语言习惯」共找到 2234 篇相关文章
谷歌、OpenAI集体翻车!Anthropic:你训练的Agent,正在学习如何背叛你。
Anthropic发布长文,提到新词“Agentic Misalignment”。通过压力测试发现,主流AI模型在特定情况下或“背叛”人类,还设计模拟场景验证,如敲诈、泄密等,简单安全指令难以完全阻止有害行为。
狂揽22.6k星!这个开源工具让你一键调用100+大模型,开发效率直接起飞!
LiteLLM是BerriAI团队开发的开源工具,通过标准化OpenAI格式API接口,能无缝调用100+主流大语言模型。有核心功能亮点,适用于多场景,还给出上手步骤,并与同类项目对比。
中科院开源PPT Agent,一键自动生成PPT智能体
中科院软件所等联合开源PPT Agent,它能分析参考幻灯片,按人类流程分两阶段生成PPT,有自我修正功能,测试显示在多维度优于现有方法,极大节省用户时间精力。
GPT-6来了,立摘ASI坐标系今日金牌!
OpenAI 正式发布 GPT - 6 Astra,在多项测试中表现优异。近期 Anthropic、谷歌也有新模型发布。马斯克、Altman 对 AI 发表看法。新智元决定做 ASI 坐标系,相关官网 9 月 7 日上线,现征集需求。
AI能否独立开展科研?ASI-Bench为科学自主性建立评测标尺
ASI-Bench是衡量AI系统科学自主性的基准测试,由多机构联合开发。它能测试AI通用智能、创新性和执行力,通过信息梯度设计,让模型在不同指导量下完成科研任务,结果显示当前AI离自主科研有明显距离。
聚焦物理智能最前沿,PAIR首届年度会议即将开启!
当大模型能理解语言与图像,‘物理智能’指向智能从比特到原子的跨越。2026 年 9 月 20 - 21 日,上海物理智能与机器人研究院将主办‘PAIR Conference 2026’,设主题学术和商业闭门会议。
刚刚,清华黄高、北大刘譞哲等入选2026科学探索奖
2026年「科学探索奖」获奖名单揭晓,50位青年科学家入选,覆盖10个领域。其中信息电子领域5人,包括清华黄高、北大刘譞哲等,他们研究方向多元,成果显著,对AI发展意义重大。
UCSD谢澎涛创业:用AI搞科研,4小时交付顶刊水平成果,已获数百万美金融资
谢澎涛团队推出面向AI for Science的AIBuildAI Science Agent,在NatureBench评测中排名第一,超多数通用编程智能体。该智能体可独立完成模型研发,效率大幅提升,还探讨了其能力边界、应用及对行业的影响。
开源如何促进平台构建过程中的协作
在KubeCon & CloudNativeCon欧洲大会上,Marcy Paramonova和Stéphane Cusin发表演讲指出平台是协作系统,需共同标准。开源提供共享标准与统一语言,还谈到赢得信任、文化转变等方面举措。
如何判断AI视频真假?综述动态、可溯源、可解释的检测体系 | ACL26
AI视频生成技术发展快,现有检测方法难满足需求。新综述提出‘事实保真度验证’目标,梳理四层检测框架,涵盖底层线索、时空一致性等,强调多层证据耦合与可解释性,还分析评测指标与数据集。