「创新潜力」共找到 1264 篇相关文章
吴恩达来信:试试语音交互吧!
吴恩达认为基于语音、可对话的AI系统在发展,语音用户界面将普及。虽不会完全取代传统界面,但会带来新应用场景。还介绍了Vocal Bridge架构,且构建语音UI可能比想象容易。
用SFT打出RL的效果?微软联合提出高效后训练算法
大模型后训练阶段,SFT 和 RL 各有优劣。微软等联合提出新工作,量化 SFT 和 RL 在数据层面的差距,提出 IDFT 和 Hinted Decoding 等高效后训练技术,实验显示新方法泛化超 SFT、效率超 RL。
DeepSeek、GPT、Qwen,所有大模型架构图都有,Karpathy:宝藏画廊!
大模型赛道热闹,架构创新多,理解困难且缺清晰架构图。AI 研究者 Sebastian Raschka 绘制主流大模型结构,整理成在线图谱「LLM Architecture Gallery」,方便研究者查阅对比。
不止是玩!有人利用Clawdbot组建了一个虚拟团队接管公司业务
AI智能客服公司SiteGPT创始人分享利用Clawdbot构建AI智能体团队‘Mission Control’的经验。该团队含10个智能体,可协同工作。系统有心跳机制控成本,还有协同平台,已产出多种成果。
「熟悉的陌生人」才是「好老师」?复旦提出简单指标,找出推理蒸馏中真正有教学价值的数据
复旦大学和上海人工智能实验室研究者提出 Rank - Surprisal Ratio (RSR) 度量方法,综合考虑样本信息量与对齐程度,在蒸馏实验中与学生模型后训练性能相关性高,可用于筛选推理轨迹和选择教师模型。
Qwen3-Max-Thinking:会想能干,比强更强
正式推出旗舰推理模型 Qwen3 - Max - Thinking,其在多关键维度显著提升,性能媲美顶尖模型。引入自适应工具调用和测试时扩展技术,现已上线 Qwen Chat,API 也开放,还介绍了使用方法。
战略落子!格芯收购新思科技这项业务
美国当地时间1月14日,格芯签署协议收购新思科技ARC处理器IP解决方案业务。该举措将加速其实体人工智能技术落地,强化竞争力,预计2026下半年完成,尚需监管批准。
微调已死!「共识机制」实现提示词自我进化,性能飙升
人工智能领域正从「模型微调」向「上下文工程」转变。西湖大学MAPLE实验室齐国君教授团队提出基于「共识机制」的提示词组进化算法C - Evolve,能突破单一提示词性能局限,提升系统整体性能。
DeepSeek-OCR生态爆发!从前端到跨平台,解锁OCR新玩法!
近年来OCR技术应用广泛,DeepSeek-OCR开源后引发开发者关注。文章盘点其四个衍生项目,有轻量级前端应用、Windows桌面应用、全Rust跨平台客户端和专业PDF转换工具,覆盖多场景。
1000 行 Java 代码手搓 OpenAI gpt-oss 推理引擎
2025年8月OpenAI发布gpt - oss,作者受相关项目启发,用约1000行Java代码实现gpt - oss推理引擎并发布在亚马逊官方github。文章分享开发体会,介绍模型架构、Java实现、性能优化等内容。