Viture Vonder AI 眼镜发布,六款镜框支持处方镜片,售价 299 美元
summary_zh: Viture Vonder AI 眼镜提供六种镜框样式,支持处方镜片,售价 299 美元,将于本月晚些时候开售。眼镜主打日常思绪的思维导图功能,将 AI 交互与时尚外观结合。 Viture Vonder AI 眼镜提供六种镜框样式,支持处方镜片,售价 299 美元,将于本月晚些时候开售。眼镜主打日常思绪的思维导图功能,将 AI 交互与时尚外观结合。
summary_zh: Viture Vonder AI 眼镜提供六种镜框样式,支持处方镜片,售价 299 美元,将于本月晚些时候开售。眼镜主打日常思绪的思维导图功能,将 AI 交互与时尚外观结合。 Viture Vonder AI 眼镜提供六种镜框样式,支持处方镜片,售价 299 美元,将于本月晚些时候开售。眼镜主打日常思绪的思维导图功能,将 AI 交互与时尚外观结合。
NVIDIA DLSS 5 推出 DLSS 3D-Guided Neural Rendering 与细粒度控制,帮助游戏开发者添加逼真光照与材质细节,同时保留艺术意图。文章同时覆盖 NVIDIA ACE、RTX Mega Geometry 2.0 与 RTX Kit 在角色 AI、高密度几何和渲染流程中的更新。
summary_zh: 研究者 Stephanie King 与 Joyce Poole 指出,AI 正被越来越多地用于动物声学数据分析,但媒体渲染的“破译动物语言”叙事可能误导科学家做出过早断言。
小米发布 MiMo-V2.6-Pro 与 Flash,均为原生全模态开源模型,Pro 在 Artificial Analysis Intelligence Index 得分 46,总参数 1.02T / 激活 42B,输入 $0.435/M、输出 $0.87/M。
推荐理由:小米推出原生全模态开源模型并附带 RL 环境与训练代码,为后训练缩放提供了一条更低成本的可复用路径。
研究团队用铅元素检测法替代碳基扫描,成功在保持卷轴卷曲状态下识别出内部文字。他们用埃及纸莎草、日本灯黑墨和高温炉复原了碳化卷轴,并通过中子与X射线断层扫描结合自定义展开程序完成破译。
Higgsfield AI 借助 GPT-6 Astra 一日内上线新视频功能,让小企业视频广告创作更便捷,并加速新创意工具推向市场。
summary_zh: Google Pixel 11 Pro XL 配备 6.8 英寸 OLED 屏幕、Tensor G6 芯片和 12/16GB RAM,售价 £1,279,较去年涨价 £80 且内存缩水。
TangleDiff 是一个深度学习框架,用于从头设计具有可编程特性的同源二聚体纠缠蛋白。其在 silico 成功率超过 70%,远高于当前模型约 1%。实验验证的 9 个同源二聚体中有 7 个成功形成水凝胶,且应力松弛动力学与指定的结合能相关。
summary_zh: Noctua NF-A4x10 5V PWM 风扇被 CAIM1 反 AI 4K 相机采用,用于同时处理高码率成像与密码学运算时的主动散热,防止设备过热降频。
GPT-6 Astra 与 Fable 5.1 已具备变革性能力,可可靠完成数周的人类工作,如将 Zork 文本冒险游戏转为 3D 动作游戏、从视频重建 Umberto Eco 图书馆的 3D 场景。
Google 工程师与设计师 Jane Wade、Sergio Hudson 合作,基于 Google Flow 打造 Styling Suite 与 Runway Visualization 两款工具。
科学家通过 AI 分析卫星影像,结合北极地区湖泊快速消失的现象,近实时追踪永久冻土融化。研究团队已绘制并持续监测北极超过 400 万个湖泊及阿拉斯加苔原上 7000 万个热喀斯特池塘。2026 年 6 月和 7 月,该地区又有约 30 个湖泊因排水受到影响。
ReScale4DL 系统评估了图像分辨率对生物图像分割的影响,在分辨率降至原始 6%-25% 的下采样图像上训练 popular architectures,分割准确率最多提升 25% mean IoU 或仅下降不到 5%。下采样同等比例提升了信息吞吐并降低存储与推理时间,为高效、可持续、低成本的生物成像流程提供实用指导。
ConvexGating 从单细胞细胞术数据的聚类结果中推断最优门控策略,旨在将聚类得到的细胞群体转化为可用于分选的高纯度、低步骤门控方案。flow cytometry、mass cytometry(cyTOF)和 CITE-seq 等高维数据场景中,手动门控依赖操作者经验且存在跨操作者变异,而聚类方法虽能无偏分离细胞却难以直接转为分选策略。
Google 发布成年雄性果蝇全脑及中枢神经系统连接组后,一名 Balatro 玩家用自研训练算法结合该结构训练模型玩 Balatro,当前随机种子胜率约 20%。玩家未公开训练细节和代码仓库,评论者对项目真实性提出质疑;Balatro 因小丑牌互动、boss 能力等复杂机制,对 AI 来说仍很难稳定通关。
MIT与协作机构开发xvr(X-ray volume registration)技术,利用患者术前3D扫描生成数千张合成X射线训练AI模型,可在数秒内将术中2D X射线与3D扫描精准对齐,精度达亚毫米级。 该模型在覆盖多医院、多器官系统的最大真实注册数据集上,比现有AI方法精度提升一个数量级,适配新患者仅需约5分钟。
推荐理由:该方法通过患者特异性合成数据训练,在真实数据集上显著超越现有AI方法,或提升微创手术的安全性与可及性。
iMagine 项目联合 11 个欧洲国家的水生科学家与数字专家,在 2022–2025 年间开发 AI 工具,帮助研究人员更快、更大规模地处理水下图像与环境传感器数据。AI 将原本需要数月甚至数年的手动分类缩短至数天到数周,并能识别浮游生物、鱼类、漂浮垃圾及珊瑚退化。该项目已公开数据集与训练工具,供其他科学家继续使用。
Google 宣布其技术和产品已覆盖全球 300 多种语言、70 亿人,占全球人口 86%。Gemini 3.5 Live Translate 支持 70 种语言、2000+ 语言对的实时口语翻译,Gemini 3.5 Transcribe 提供高精度语音转文本。
推荐理由:原文展示了从文本到音频理解再到端侧翻译的技术路径,读者可以据此判断 Google 在多语言 AI 交互上的最新能力边界。
summary_zh: Google 与全球社区和研究者合作,在疾病预测、自然灾害预警、教育普及和经济机会拓展等关键领域推动 AI 从理论走向可衡量的实际影响。
Google宣布其AI技术已支持超过300种语言,覆盖全球70亿人口(86%全球人口),并发布AI & Economy ATLAS互动洞察。同时公布AlphaGenome Atlas、WeatherNext 3、Planetary Prediction Engine等科学进展与应用。
summary_zh: 日本东京大学研究团队基于 Smith hat 单密铺形状在氮化硅薄膜上构建纳米光学结构,激光照射后产生手性衍射图样,表现出与传统准晶体不同的对称性控制光学响应。
费城儿童医院使用 MONAI 等开源工具,将儿童心脏建模时间从数小时缩短到秒级,已用于术前规划和部分手术。波士顿儿童医院将建模用于约半数心脏手术,医院间正组建开源联盟。
推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。
summary_zh: NASA 宇航员 Christina Koch 与 Google 高级研究副总裁 James Manyika 对谈,分享在国际空间站停留 328 天、完成首次全女性太空行走及 Artemis II 绕月任务的经历。
MIT CSAIL团队提出反事实删除方法,发现训练数据越大,单个样本对生成输出的影响按幂律衰减至不可测。研究训练了24个扩散集成模型,覆盖CIFAR-10、CelebA、MetFaces、ArtBench等数据集,结论在多种相似度度量下统计显著。论文发表于Nature Communications,作者Zheng Dai、David Gifford。
Meta 推出个人 AI 智能体 Muse,功能包括预订旅行、处理邮件和完成电脑上的任意任务,可连接 Facebook 与 Instagram 账号,初期仅对美国成年人开放。Meta 将其定位为比 Grok Bot、Instinct 等更安全,并主打个人代理场景。
Encode-prefill-decode(EPD)拆分是一种多模态模型推理优化技术,将视觉编码器阶段与 prefill 和 decode 阶段分离。该技术在图像密集型提示、短到中等长度输出以及量化 MoE 模型上效果最显著。结合 NVIDIA Dynamo 可实现最高 5 倍加速。
summary_zh: Google DeepMind 与 Primordial Soup 合作,为纪录短片《Love, Rendered》用生成式模型修复黑白旧照,并用性能捕捉模型映射 Burt 与 Ethelle 当下的微表情与姿态,将其映射到年轻形象上。
GPT-6 Astra 是 OpenAI 面向商业场景的最强模型,具备高级推理、计算机使用能力,以及更强的写作与设计判断力。
Isla Duporge 结合无人机视频、卫星影像与深度学习追踪动物行为,研究斑马群体逃逸时的结构变化与 Monarch 迁徙的向量定向。卫星普查的角马数量低于此前估计,AI 检测可补充开阔栖息地的航空调查。 quieter 无人机、更长续航与更小型化生物记录标签将推动群体行为从模型预测转向可观测验证。
RIKEN AIP 音乐信息智能团队(团队长浜田正敏、研究员三浦裕也、客座研究员小室哲也、JSPS PD 关真太郎)凭借「School Song Creation with Student Participation Using AI Composition Support」获得 IPSJ SIG 音乐与计算机科学最佳演示奖。该奖项由 SIG 委员会根据参会者投票选出,表彰研究发表表现。
研究者用商用组件搭建低成本摄像系统,在红三叶草田中记录到6种大黄蜂,与传统网捕和陷阱的物种多样性吻合。图像分析采用分块(tiled)深度学习模型,优于整图评估;靶心图案比纯色背景更能吸引大黄蜂。该技术可为濒危物种评估和栖息地划定提供更密集的大规模监测数据。
Google Research与HHMI Janelia及剑桥合作者发布完整雄性果蝇大脑和中枢神经系统连接组,包含166,000个神经元和1.25亿个突触连接,是迄今最大脑图谱。研究利用AI和计算技术构建细胞级全脑图谱,配套Neuroglancer开源可视化工具,并已用于视觉、味觉和社会行为研究。
NeoMME是260M和800M多模态原生多语言编码器,单塔双向Transformer从零训练,无需独立视觉塔或因果语言模型。260M模型在ViDoRe v3上达0.523 nDCG@10,超越同参数模型,编码速度约2倍于ColModernVBERT。通过分层池化和非对称量化,late-interaction存储从1.5MB压缩至6kB/页,压缩255倍且保留95%以上检索质量。
推荐理由:单塔多模态编码器以260M参数在ViDoRe v3上超越更大模型,并通过分层池化和非对称量化将多向量检索存储压缩255倍同时保留95%以上质量。
Google 发布 Gemini 3.7 Flash,定位为编码与智能体工作负载的最强基础模型,定价为 3.6 Flash 的一半;同步推出 Gemini 3.5 Transcribe 语音转文本模型。
推荐理由:Google 在一个月内连续发布两款 Flash 模型并下放到 Pixel 硬件,开发者可以用更低成本构建智能体。
Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 上推出智能体视频理解功能,视频分析 token 消耗最高降低 88%、成本最高降低 66%、准确率最高提升 7%。
推荐理由:原文给出了 token 与成本降幅的具体数字和 API 启用方式,读者可据此判断长视频分析的成本边界。
summary_zh: NVIDIA BioNeMo NIM 微服务可在 Claude Science 中用于蛋白质结构预测。Agentic AI 正在改变科研方式,AI 科学家能阅读论文、提出假设、调用模型并决定实验优先级。
墨尔本大学等机构提出GenMix方法,通过九种预设提示对真实图像做可控编辑并与原图融合,再经过滤丢弃语义漂移样本,将数十张标注图像扩增至数百张。测试覆盖日常物体识别、细粒度识别、小数据集和跨域场景,模型被微小像素对抗样本欺骗的比例降低约30%;代码已开源,作者强调临床使用仍需独立验证。
MIT 生物系推出 PottsMPNN 机器学习框架,融入物理原理以改进序列生成与突变稳定性预测。该模型通过引入噪声、氨基酸配对分布和进化相关序列训练,更好地理解序列-能量景观,能为无天然对应序列的全新设计结构生成可行序列。研究显示,减少对天然序列的依赖可提升结构兼容性与能量预测精度。
Google DeepMind 发布 Gemini Omni 1.1 Flash,面向开发者提供场景续写、首尾帧插值、视频参考和 4K 放大等生成视频控制能力。
推荐理由:相比前代只参考最后 1 秒画面,新版本可读取 10 秒上下文并把视频续写到 40 秒,开发者可据此判断生成视频的可控程度。
NASA Starling任务通过FALCON系统利用星上相机识别其他航天器和轨道碎片,结合国防部公开目录计算自身轨道,实现GPS独立导航。三天内自主精化了200多个物体的轨道估计,精度超过地面目录数据。