AI 早报

每日 AI 新闻早报 — 精选最重要的 AI 资讯,用中文呈现

2026-08-13
2026-08-12
2026-08-11
2026-08-10
2026-08-09
2026-08-08
2026-08-07
2026-08-05
2026-08-04
2026-08-03
2026-08-02
2026-08-01
2026-07-31
2026-07-30
2026-07-29
2026-07-28
2026-07-27
2026-07-26
2026-07-23
2026-07-22
2026-07-21
2026-07-20
2026-07-19
2026-07-18
2026-07-17

前蔚来、华为智驾核心成员创业具身世界模型,日冕开物三个月完成数亿元融资

具身智能世界模型公司日冕开物(北京日冕机器人有限公司)近期完成连续两轮种子轮融资,合计金额达数亿元人民币,投资方包括鼎峰科创、远图未来、百度风投等。公司由前蔚来、华为智驾核心成员创立,自主研发世界模型LaMPA,旨在解决机器人物理世界理解与跨场景泛化难题,并已进入高精度工业装配场景。

36氪 AI 22:58 AI 辅助 人工智能 机器人 具身智能
2026-07-16
2026-07-15

面壁智能端侧大模型将搭载三星手机上市

面壁智能与三星达成合作,其自主研发的MiniCPM系列端侧模型将覆盖数款三星旗舰机型上市。同一天,包括Apple智能、华为小艺等七款手机端侧AI服务获网信部门备案,标志着端侧AI进入规模化落地阶段。

36氪 AI 23:05 AI 辅助 AI 科技 手机
2026-07-14
2026-07-13

AI家庭硬件公司MOVA LINCO获数千万元天使融资,首款AI路由器年内上线海外

AI家庭智能硬件公司MOVA LINCO完成数千万元天使轮融资,将用于AI算法研发及全球化布局。其首款AI智能语音路由器X1 Pro支持自然语言交互和全屋Mesh组网,预计2026年下半年在海外上市,同时AI NAS和AI算力盒子也将同步推进,构建“连接+存储+算力”三位一体的家庭AI基础设施。

2026-07-12
2026-07-11
2026-07-10
2026-07-09

昇视唯盛完成数亿元B轮融资,自研焊接具身智能机器人切入工业制造赛道

工业具身智能机器人企业「昇视唯盛」宣布完成数亿元B轮融资,资金将用于焊接具身智能大脑与运动控制系统迭代,扩大智造工厂产能。公司以自研“智能焊工”机器人切入千亿级焊接市场,通过AI算法实现自主感知与动态调整工艺,当前一台机器人可替代1.5到2名焊工,投资回报周期约1-1.5年。

36氪 AI 23:21 AI 辅助 科技 工业制造 机器人
2026-07-08
2026-07-07

[EN] MELON:无需初始位姿即可从图像中重建3D物体

Google Research团队提出MELON技术,能在不依赖相机初始位姿、预训练或复杂训练方案的情况下,仅凭4至6张未标注位姿的2D图像,高精度重建物体3D模型。该技术通过轻量级CNN编码器动态回归相机位姿,并引入模损失(modulo loss)处理物体伪对称问题,为3D重建领域提供了一种简洁且易于集成的解决方案。

Google AI Blog 23:13 AI 辅助 计算机视觉 3D重建
2026-07-06

[EN] MELON:无需相机位姿从图像重建3D物体

Google Research团队提出MELON(模等价潜在优化NeRF)技术,能在完全没有相机位姿先验信息的情况下,仅用4-6张2D图像就重建出3D物体,通过轻量CNN编码器与模损失函数解决了长期存在的位姿与3D结构间的“先有鸡还是先有蛋”难题。

Google AI Blog 03:29 AI 辅助 计算机视觉 3D重建

[EN]Google提出ScreenAI:统一理解UI与信息图的视觉语言模型

Google研究人员推出ScreenAI,一种基于PaLI架构与pix2struct灵活分片策略的视觉语言模型,仅5B参数即可在UI与信息图理解任务上达到业界领先水平。模型通过自监督预训练与人工标注微调,结合大规模屏幕标注数据,能完成UI元素识别、导航、问答等任务,并开源了三个新数据集。

Google AI Blog 03:29 AI 辅助 人工智能 计算机视觉 自然语言处理
2026-07-05

[EN] ScreenAI:面向UI与信息图的视觉语言模型,5B参数达SOTA

Google Research发布ScreenAI,一种基于PaLI架构并融合pix2struct灵活分块策略的视觉语言模型。该模型在仅有5B参数的情况下,在WebSRC、MoTIF等UI及信息图任务上达到最优水平,并在Chart QA、DocVQA等基准测试中超越同规模模型。研究团队还开源了Screen Annotation、ScreenQA Short和Complex ScreenQA三个新数据集。

Google AI Blog 01:52 AI 辅助 人工智能 计算机视觉 自然语言处理
2026-07-04

[EN] Google推出ScreenAI:端到端视觉语言模型,统一理解UI界面与信息图表

Google Research发布ScreenAI,一种基于PaLI架构并融合pix2struct灵活分块策略的5B参数视觉语言模型,专为理解用户界面与信息图表设计。通过自监督预训练和屏幕标注任务,ScreenAI在WebSRC、MoTIF、ChartQA等多项基准测试中达到或超越同规模模型的最优性能,同时发布了三个新数据集。

Google AI Blog 06:39 AI 辅助 人工智能 多模态模型 人机交互