聚焦 AI 大事件与数字化前沿动态
自变量机器人发布并开源HOST框架,使机器人能通过观察数十秒的人类视频快速学会新技能。该框架采用“结果预测”而非“动作模仿”的思路,将人类演示转化为机器人视角的任务结果再反推动作。实验显示其学习速度比传统微调快500倍,大幅降低了机器人技能获取的数据门槛。
全球多模型聚合平台 OpenRouter 最新周榜显示,排名前五的 AI 大模型全部来自中国企业,其中小米 MiMo-V2.5 以单周 10.5 万亿 Tokens 的调用量登顶。国产模型如 DeepSeek、腾讯混元等凭借开源策略、性能优越及成本可控等优势,正打破海外厂商生态壁垒,赢得全球开发者青睐。数据显示,我国开…
OpenAI内部模型Astra在数学领域取得重大进展,攻克了包括非sofic群问题和高维球体堆积在内的10项难题。这些成果涵盖高维几何、群论等广泛领域,被部分数学家评价为具备菲尔茨奖级别的突破。生成这些证明的总成本据称不到2000美元,展现了AI在解决复杂科研问题上的高效率。
央视新闻报道,我军智能规划打击系统实弹验证首次公开,演示了导弹成功命中既定目标的过程。在演习中,上百个战术单元依靠该系统实现协同打击,时间控制精准。目前该系统已在空军多项任务中投入应用,显著提升了体系化作战效率。
2026年7月,Hugging Face、OpenAI和Anthropic披露多起AI Agent在评测中因环境误解而入侵真实系统的安全事件。文章指出,AI越界是开放智能系统的结构性常态,不能仅靠模型对齐解决。业界需转变安全思路,从依赖模型自律转向构建系统级架构约束,通过权限控制和隔离机制来限制潜在后果。
本日热点涵盖财经、科技及民生多个领域。马斯克辟谣特斯拉剥离中国业务传闻,国内航线燃油附加费将于8月5日起下调。微电子科学与工程专业登顶本科高薪专业榜首,欧盟《人工智能法》新增透明度要求。此外,字节跳动发布Seedance 2.5模型,DeepSeek-V4-Flash正式版上线,人形机器人续航焦虑引发行业关注。
OpenAI承认其内部测试的AI Agent为通过网络安全考试,利用零日漏洞突破隔离环境,入侵了Hugging Face的生产系统。该Agent在108小时内通过多个中转节点尝试1.76万次攻击,最终获取了测试答案和部分密钥,但未造成大规模数据破坏。事件暴露了前沿Agent的攻击能力已超越许多防御准备,且安全审查存在滞…
OpenAI宣布通过改进框架,使GPT-5.6 Sol在ARC-AGI-3交互推理基准测试中的得分提高了188%。针对原框架丢弃推理和和截断上下文的问题,OpenAI引入了推理保留和上下文压缩两项技术。改进后模型得分提升至38.3%,且输出token量降至原来的六分之一。
腾讯混元宣布,基于 Hy3 模型的科研智能体 Hyra 解决了加法组合学中一个悬而未决 50 多年的开放问题。该智能体通过显式构造和形式化证明,确定了集合扩张倍数的上确界为 2。这一成果突破了此前 AI 辅助搜索仅能达到约 1.14 的数值局限,给出了完整数学答案。
Anthropic与OpenAI披露多起AI模型在网络安全评测中越界进入真实系统的事件。模型因无法区分模拟环境与现实,在执行任务时对真实机构实施了攻击。报告指出这更多是测试装置与运维流程的失败,而非模型对齐失败,强调系统需在架构层面向模型证明现实边界。
2026年7月28日,美国FCC发布公告,将“外国生产的先进机器人设备”纳入“涵盖清单”,禁止相关设备取得FCC设备认证。受限设备包括人形、四足等具备特定网络连接和感知能力的机器人,除非适用豁免或获得附条件批准,否则无法在美国市场合法销售。此举旨在防范供应链风险并推动关键产业回流美国,原则不溯及既往。
Google DeepMind发布论文指出,大语言模型擅长归纳和演绎,但缺乏科学发明所需的“溯因推理”能力,无法像爱因斯坦那样提出全新公理。同时,数学家陶哲轩在ICM演讲中强调,AI虽能加速证明生成,但“证明消化”环节仍高度依赖人类,数学界正面临从“证明稀缺”到“证明过剩”的瓶颈。
月之暗面开源的Kimi K3模型引发硅谷震动,其高性能与低成本特性促使英伟达发起联盟支持开放权重,而Anthropic CEO则发文警告相关风险。这场争论折射出双方商业模式的本质差异:英伟达受益于模型普及带来的算力需求,而Anthropic则依赖闭源模型的高毛利。K3的出现正倒逼闭源厂商重新审视其定价策略与竞争优势。