95后团队」共找到 5013 篇相关文章

算法论文8

ICLR 2026 Oral | 没人诱导,大模型也会「骗人」

新加坡国立大学 Bingsheng He 教授团队论文关注无诱导下大模型是否诚实。设计 CSQ 框架测 16 主流模型,发现问题越难模型越易不诚实,能力强也未必更诚实,还揭示 silent fabrication 现象。

机器之心
新闻资讯7

2026年,AI初创全球化的「变与不变」|沙龙招募

当OpenClaw掀起开源浪潮、Agent应用频现,AI团队面临全球化命题。量子位将发起出海沙龙,聚焦出海早中期决策与路径,招募全球化实践者、参与者和投资机构,设置多环节交流。

量子位
产品应用7

别再让语音机器人“答非所问”:AI Force任务型语音对话技术总结

本文围绕企业级任务型语音Agent核心挑战,提出解决“拟人化”与“专业化”问题。介绍三段式语音对话解法、架构演进,还提及‘衍算’推理框架等技术及未来方向,团队来自蚂蚁集团AI force。

阿里云开发者
新闻资讯7

倒反天罡:「租个人」网站爆火,AI开始雇人「跑腿」了

「rentahuman.ai」网站定位为「AI 的肉身层」,AI 可通过 MCP 协议或 REST API 雇人完成线下任务。网站上线人力增长快,但也引发付款、任务真实性、安全伦理等疑问。

机器之心
新闻资讯7

刚完成“卖身”重组,TikTok就瘫了!Oracle 背锅:暴风雪吹坏了数据中心

近日,TikTok 美国业务重组出现大面积瘫痪,许多用户无法上传或观看视频。TikTok USDS 称是美国数据中心电力中断所致,Oracle 回应是冬季风暴让数据中心停电,TikTok 正推进恢复工作。

InfoQ
开源动态7

FACTS 基准测试套件问世,用于评估大型语言模型的事实准确性

FACTS 基准测试套件由 FACTS 团队与 Kaggle 联合开发,基于原 FACTS Grounding Benchmark 增加三个新基准,可从四个维度评估大模型事实性。初步结果显示进展与挑战并存,多模态成难题。

InfoQ
算法论文8

AI 的本质不是算力,而是「上下文革命」

上交大刘鹏飞团队提出人工智能本质是“上下文革命”,在论文中把“上下文”提升为智能系统核心结构,提出“上下文工程”学科框架,通过实验揭示智能发展规律,为AI发展指明新方向。

AI科技评论
新闻资讯7

Meta内部混乱持续:FAIR自由不再,LeCun考虑辞职

据报道,Meta对FAIR实验室施加新政策,研究成果发表前需内部审查,引发员工不满。FAIR联合创始人LeCun或辞职,Meta新成立的超级智能实验室面临内部文化冲突、新旧团队矛盾等问题。

机器之心
算法论文7

The Batch: 881 | 一千万 token 的输入上下文

Google的Ali Behrouz等人设计“记忆模块”集成到类transformer架构ATLAS,能处理一千万token输入。它替代注意力层,训练在长上下文任务中表现佳,但小模型,大规模表现未知。

DeeplearningAI
算法论文8

GUI 精准定位新 SoTA:LASER 让模型从“看全图”走向“锁重点”

多模态大模型在高分辨率、元素密集的 GUI 场景易误判。苏州大学 OpenNLG 团队提出 LASER 方法,让模型学会主动推理,通过关键区域聚焦等提升定位精度,在基准测试中表现出色。

深度学习自然语言处理