英伟达2026年发布的EgoScale框架,用20,854小时的第一视角人类视频训练VLA模型,第一次在具身智能领域画出了一条清晰的对数线性扩展曲线——人类数据小时数与验证损失呈对数线性关系,R² = 0.998,在 22 自由度灵巧手上平均成功率提升 54%。
反观现在的人形机器人,光是站着、保持平衡,就要吃掉巨大电能。两条腿走路本身极耗能——人腿是亿万年演化的肌肉、肌腱、骨骼组合,机器要用电机、减速器、传感器去复刻这套双足系统,代价极高。
据作者介绍,这些人脸涂鸦是用 Canvas 2D 绘制的,每个五官都对应一个函数,关键技巧是把这些特征放在一个粗糙的 3D 头部模型上,这样当脸部倾斜或旋转时,五官能正确跟随定位。
过去78年里,所有人都在追问同一句,S⁶上到底有没有复结构。而从这一刻开始,该问的可能已经是另一句了。 一道悬了整整78年的世纪难题,三天就被破了! 问题是六维球面上到底有没有复结构,从1948年一路问到今天,现在答案是有。 给出这份答卷的,是哈佛数学家Levent Alpöge和Claude。 更狠的是破局的手法。 他们绕开了所有人走了几十年的老路,直接动手把这个东西造了出来,然后指着它宣告,这 ...
OpenRouter是全球最大的模型网关之一,一头接着约70家模型供应商,一头接着开发者,一周要处理28万亿token。按它的联合创始人兼COO Chris Clark估算,这大约是全球推理量的1%,其中一半来自美国。这1%的token,又是怎么分出哪些是人、哪些是Agent的?
最重要的 AI 开源平台 Hugging Face(抱抱脸)正在探索出售,接触买家中,估值可能达到 130 亿美元(约 870 亿元人民币)甚至更高。 https://www.businessinsider.com/hugging-face-could-be-acquired-13-billion-2026-8 ...
Graph 就没那么新了。状态机、DAG、工作流编排、事件驱动、分布式调度,软件行业早就做了很多年。真正有意思的变化,只是图里有些节点不再执行一个固定函数,而是塞进了能理解局部目标、自己选择动作的概率型执行器。
这些特征随后被带入仿真。足球距离越远,位置噪声越大;相机视野会随机器人头部姿态变化。即使足球出现在视野中,也可能因为运动模糊等原因检测失败。视觉系统以约 25Hz 更新,平均延迟约 116 毫秒。
IT之家曾于今年 7 月报道,微软曾于 2024 年启动开发 Project Aion 系统项目,内部名为 CopilotOS,围绕着 Copilot AI 构建,描述为用户表达、娱乐、学习和处理日常事务的主要入口。 Aion 被描述为“一款可以在运行 AOSP、Win3 甚至 Windows 11 的各种新型 AI 专用设备上运行的智能体 Copilot 操作系统”。
斯坦福大学教授、Simile AI 创始人 Percy Liang@percyliang 宣布由 Marin 开放实验室启动训练 Marin 535B-A23B 模型,并且整个训练过程将全程公开进行。 最近两天,X 上网友 Max For AI@MaxForAI 的一篇帖子引发了网友热议:「太疯狂了 —— 现在你甚至可以直播围观一个 535B 大模型是如何被训练出来的。」 原来是斯坦福大学教授、S ...
与此同时,微软、Amazon、Google、Meta 和 Oracle 今年的资本开支预期已经达到约 7300 亿美元。服务器涨价,无疑会让这场万亿级 AI 基建竞赛变得更加昂贵。 当然,服务器售价上涨,不代表每个 Token 的成本一定同步上涨。英伟达宣称,Rubin 运行部分工作负载时,每 Token 成本最高可比 Blackwell 降低 10 倍。
结果令人吃惊:对比当前的主力机皇GB300 NVL72,Vera Rubin的每兆瓦吞吐量最高飙升了30倍、Token成本最高暴降了35倍! 按照老黄的摩尔定律,合着这两年英伟达最大的技术突破不是GPU本身,而是让价格贵了4倍,却换来了整整900倍的速度飞跃!