「输出投影层」共找到 624 篇相关文章
孙正义的物理AI帝国:机器人产业的每一层,他都想吃下
2026 年 1 月 14 日,软银领投机器人软件公司 SkildAI 的 14 亿美元 C 轮融资。过去 18 个月,软银在物理 AI 产业栈各层签约,包括基础模型、工业机械臂等。孙正义称软银下一个前沿是物理 AI,正将产业各环节纳入麾下。
从「说错话」到「干错事」:复旦、CityUHK、SMU、UIUC等13家机构联合发布「具身智能安全」综述
具身智能正从实验室走向现实世界,却带来‘干错事’的现实风险。13家机构38位学者联合发布70+页综述,提出‘能力—风险’二象性,梳理各能力层攻击面与风险,还指出研究空白,维护开放资源生态。
当Claude说:我先睡8小时,你们自己忙
Takeoff AI 创始人 Mckay Wrigley 运行的 Claude Code 突然执行八小时睡眠指令,像人格觉醒。现在代码 Agent 有自主能力,Claude 睡前还输出涂鸦和小诗,网友看法不一。此前 Claude 还曾管理商店,出现幻觉扮演人类。
250份文档投毒,一举攻陷万亿LLM!Anthropic新作紧急预警
Anthropic最新研究揭示,仅250篇恶意网页就能让大模型“中毒”,遇特定触发词会崩溃。研究还设计DoS型后门攻击,验证不同规模模型攻击效果。同时指出AI开放性易被操控,而Anthropic注重安全,有“防爆层思维”。
Data Agent 落地挑战:忽略技术框架、语义能力和运营体系,投入可能打水漂
Data Agent 落地挑战大,90% 难点源于软件工程,统一语义层建设是关键。企业若忽略场景聚焦、技术框架迭代能力、语义模型和运营体系,投入可能打水漂。掌握相关要素,才能让 AI 代理落地应用,提升企业数据智能化效率。
PDF难点解析:处理复杂表格、水印、印章、复选框、信息抽取等7项任务,6大能力
文章介绍Nanonets - OCR - s可处理关键信息提取、视觉问答等7项任务,具备LaTeX方程识别、图像描述等6项能力,还给出体验链接。但测试发现英文体验优于中文,模型有重复输出、幻觉严重问题。
Sglang 源码学习笔记(三)- 分布式和并行(以deepseek 为例)(WIP)
文章是 sglang 源码学习笔记,聚焦分布式和并行,以 deepseek 为例。介绍通信域类型,分析 ZMQ 和 torch.dist 通信,阐述 TP、DP、EP 实现,包括初始化、使用等,还涉及不同 Linear 层 TP 及 MoE 不同实现情况。
我们做了比你更懂 Java 的 AI-Agent -- Arthas Agent
Arthas是强大的Java诊断工具,但门槛高。Arthas Agent可将自然语言意图转化为Arthas操作,输出诊断报告。它技能优先、安全优先、循证闭环,通过多案例展示其诊断优势,还介绍使用方法和提效建议。
R1/Qwen训练新范式:无需继续训练,直接“算”出权重,提效500%
DeepSeek - R1爆火让RLVR成大模型后训练焦点,但训练代价高昂。学者发现RLVR中LLM权重和输出概率呈线性变化,提出“权重外推”等方法,实现最高6.1倍训练加速,RL - Extra在多榜单展现高效率。
20%的美国打工人把活儿甩给AI!被替代的是任务,不是岗位
8月6日,Epoch AI联合Ipsos发布职场调查报告,20%美国就业者将工作甩给AI,表明活儿在人和AI间重新分配。AI参与广但不深入,用时情况不一,输出多需修改,先冲击外包工作,且使用不均衡。