📰 科技脉搏
2026-08-12
🔥 AI & 科技
Learning reliable surgical manipulation policies is bottlenecked by the scarcity of action-labeled demonstrations: teleoperated surgical robot (e.g., dVRK) trajectories with synchronized kinematics are costly to collect, while surgical tasks demand precise contact handling, long-horizon reasoning, a
📅 08-11📎 arXiv AI Papers
Synthetic dialogue generation offers a way to study conversational dynamics in sensitive domains where real data are difficult to access, release, or annotate. The underlying abuse may occur online or offline: threats and coercion can appear directly in messages, while behaviours such as surveillanc
📅 08-11📎 arXiv AI Papers
AI agents are increasingly used in mathematics research, but it is often unclear how to use them effectively. Towards this, we present an extensive case study of how AI was used to improve bounds on the Grothendieck constant $K_G$, which captures the hardness between combinatorial problems and their
📅 08-11📎 arXiv AI Papers
提出测试时自进化方法,通过反射引导的在线策略自蒸馏技术提升GUI视觉定位能力。模型能在推理阶段持续优化自身,无需额外训练数据,显著增强界面元素识别精度与跨场景泛化性能,为智能体界面理解提供高效解决方案。
📅 08-11📎 arXiv AI Papers
系统探讨概率声明一致性验证问题,提出多层级检验框架,涵盖概率公理约束、条件概率推理及贝叶斯一致性检查。为学术研究与实际应用中评估概率性结论的可靠性提供实用方法论,助力减少推理错误与误导性断言。
📅 08-11📎 arXiv AI Papers
回顾TrustNLP研讨会六年研究成果,梳理可信自然语言处理从模型解释到主动控制的范式演进。总结可解释性、公平性与鲁棒性领域的关键突破与开放挑战,展望未来构建可验证、可干预的可靠NLP系统的发展路径。
📅 08-11📎 arXiv AI Papers
提出将注意力路径脆弱性作为大语言模型的不确定性信号。通过分析模型内部注意力分布的稳定性,识别预测中的不确定区间,无需额外训练即可评估置信度,为LLM可靠性提升提供新视角。
📅 08-11📎 arXiv AI Papers
提出结构逻辑张量网络sLTN,将逻辑规则与张量网络结合,实现可微分的符号推理。相比传统LTN,sLTN引入结构化建模,提升复杂关系学习能力,在知识库推理与神经符号任务中表现更优。
📅 08-11📎 arXiv AI Papers
设计两阶段奇残差流用于保持均值的概率时间序列预测。通过残差流建模复杂分布,并引入均值保持约束,确保预测期望准确。实验表明该方法在不确定性与点预测精度上均优于现有基线。
📅 08-11📎 arXiv AI Papers
本文探讨智能体编程中CLAUDE.md文件无限膨胀的现象,提出“灾难性记住”概念。研究发现,AI智能体倾向于将临时性、边缘性信息永久写入记忆文件,导致上下文冗长、性能下降。作者分析了这一机制背后的认知偏差,并提出了动态记忆管理策略,以提升编码智能体的长期稳定性与效率。
📅 08-11📎 arXiv AI Papers
谷歌AI最新研究推动AMIE系统向专家级视听临床咨询发展。AMIE结合音频与视觉信号,实现多模态医学对话,能更准确识别症状与情绪,为远程医疗和临床决策提供有力支持,展现AI在医疗领域的巨大潜力。
📅 08-11📎 Google AI Blog
💰 财经 & 投资
晚点独家获悉,智谱AI的API用户数已接近700万,并新启用超5万块国产算力芯片。此举显示智谱在国产大模型商业化与自主算力建设上推进迅速,也反映国内AI产业对算力自主可控的迫切需求与积极实践。
📎 晚点LatePost
由 Hermes 自动生成 | 查看历史摘要