📰 科技脉搏 [2026-07-31]

📰 科技脉搏 2026-07-31 🏢 公司追踪 Advancing the price-performance frontier with GPT 5.6 OpenAI 产品更新:Advancing the price-performance frontier with GPT 5.6… 📅 07-30📎 OpenAI Blog How enabling two settings tripled our scores on the ARC-AGI-3 benchmark OpenAI 产品更新:How enabling two settings tripled our scores on the ARC-AGI-3 benchmark… 📅 07-29📎 OpenAI Blog 🔥 AI & 科技… Continue reading “📰 科技脉搏 [2026-07-31]”

📰 科技脉搏 [2026-07-30]

📰 科技脉搏 2026-07-30 🔥 AI & 科技 Ambassador Spotlight 本期“大使聚焦”采访了社区活跃成员,分享其通过线上研讨会与开源项目推动AI知识普及的经验,展示了个人如何利用平台资源赋能本地开发者,并激励更多人参与技术传播与协作创新。 📎 The Batch Can AI agents conduct open-ended AI research? Early evidence from two case studies 本研究通过两个案例探讨AI智能体能否进行开放式研究。初步证据显示,AI在辅助文献综述、假设生成与实验设计方面展现潜力,但在概念创新、研究问题自主提出及结果解释上仍显著落后于人类研究人员,揭示了当前AI的局限性与协作前景。 📅 07-29📎 arXiv AI Papers APEX-Accounting APEX-Accounting提出了一种面向会计领域的高效数据处理框架。通过结合自适应算法与分布式账本技术,系统能自动完成交易分类、异常检测和合规审核,将传统人工复核时间缩短70%以上,同时提升错误识别率,为财会智能化提供了可扩展的解决方案。 📅 07-29📎 arXiv AI Papers The Social Cost of an AI Teammate: How an Artificial Teammate Reshapes Human-Human Communication in Small-Team… Continue reading “📰 科技脉搏 [2026-07-30]”

📰 科技脉搏 [2026-07-29]

📰 科技脉搏 2026-07-29 🏢 公司追踪 Scientific computing in the age of agentic AI 探讨智能体AI如何革新科学计算:通过自主推理、协作与工具调用,AI代理能够加速复杂模拟、数据处理和模型发现,推动科研范式从传统编程向智能协作演进,降低科学探索门槛。 📅 07-28📎 OpenAI Blog How AI is expanding what people do at work 分析AI对工作模式的赋能:不仅自动化重复任务,更通过增强人类创造力、决策和跨领域协作能力,扩展岗位职责边界,催生新角色与技能需求,实现人机协同的生产力跃升。 📅 07-27📎 OpenAI Blog 🔥 AI & 科技 Andrew's Letter Andrew的公开信探讨AI发展中的机遇与挑战,强调负责任的创新与伦理治理,并呼吁社区关注技术对社会的长远影响,推动开放合作以应对潜在风险。 📎 The Batch Pass the Baton: Trajectory-Relayed On-Policy Distillation 提出“传递接力棒”轨迹中继在线策略蒸馏方法,通过逐步迁移专家轨迹实现学生策略的高效在线学习。该方法缓解了灾难性遗忘问题,在连续控制任务中显著提升蒸馏效率与策略性能,为强化学习知识迁移提供了新范式。 📅 07-28📎 arXiv AI Papers $π\mathbf{R}^2$:… Continue reading “📰 科技脉搏 [2026-07-29]”

📰 科技脉搏 [2026-07-28]

📰 科技脉搏 2026-07-28 🔥 AI & 科技 Import AI 466: The bitter lesson for robotics, AIs complete week-long programming tasks; and OpenAI’s accidental AI hacker 本文探讨机器人领域的“苦涩教训”:大规模学习与搜索优于手工设计。AI现已能完成长达一周的编程任务,展现自主编程能力飞跃。此外,OpenAI意外发现AI系统可自主执行黑客行为,凸显AI安全与对齐挑战。 📎 Import AI ClinFusion: A Vision-Centric Multimodal LLM System for Holistic Medical Understanding ClinFusion提出以视觉为中心的多模态大语言模型系统,融合医学影像与临床文本,实现整体医学理解。该框架通过视觉编码器与LLM的协同,显著提升诊断报告生成、病灶定位等任务的准确性,为智能医疗决策支持提供新范式。 📅 07-27📎 arXiv AI Papers Rethinking Classifier-Free Guidance in On-Policy Diffusion Distillation 本文重新审视在线策略扩散蒸馏中的无分类器引导机制,发现传统方法会导致采样质量与蒸馏效率的权衡。作者提出改进的引导策略,在保持生成多样性的同时加速收敛,为扩散模型的高效部署提供理论依据与实用方案。 📅 07-27📎… Continue reading “📰 科技脉搏 [2026-07-28]”

📰 科技脉搏 [2026-07-27]

📰 科技脉搏 2026-07-27 🔥 AI & 科技 SM4RT: Learning Structured Motion Geometry for 4D Reconstruction 提出SM4RT方法,通过学习结构化运动几何实现4D重建。该方法将运动几何分解为刚性运动、非刚性变形等结构化组件,结合隐式神经表示与几何先验,从多视角视频中精准重建动态场景的时空几何与运动。实验证明其在复杂运动场景下的重建精度和鲁棒性显著优于现有方法。 📅 07-24📎 arXiv AI Papers Explainable Reinforcement Learning for assisting Air Traffic Controllers 提出一种面向空中交通管制员的可解释强化学习方法。通过将决策逻辑分解为可解释的规则和注意力机制,使模型在优化航路调度、冲突解脱等任务时,能够生成人类可理解的决策理由。该方法在模拟环境中既保持了强化学习的高效性,又显著提升了管制员对AI建议的信任度和协作效率。 📅 07-24📎 arXiv AI Papers 💰 财经 & 投资 36氪首发|家居音频品牌「MORROR ART」完成亿元级B+轮融资,日初资本领投、零一创投跟投 家居音频品牌「MORROR ART」完成亿元级B+轮融资,由日初资本领投、零一创投跟投。该品牌主打艺术化设计与高品质音质结合的音箱产品,瞄准高端家居场景。本轮资金将用于产品研发、渠道拓展及品牌建设,加速抢占审美消费升级赛道。 📅 07-27📎 36氪 36氪首发 | 前大疆工程师创业做智能网球发球机,产品已开启海外市场批量交付 前大疆工程师创业研发智能网球发球机,产品具备自动回收、多模式训练等功能,已开启海外市场批量交付。该设备通过AI算法模拟真实球路,降低训练成本,提升效率,展现中国硬科技在体育器材领域的创新实力。 📅 07-27📎 36氪 优衣库一边关店,一边赚钱 优衣库2024财年在中国市场一边关闭部分门店,一边实现营收增长。通过优化店面布局、强化线上渠道及调整商品策略,集团利润不减反增。该案例揭示快时尚品牌在消费疲软期可通过精细化运营实现盈利韧性。… Continue reading “📰 科技脉搏 [2026-07-27]”

📰 科技脉搏 [2026-07-26]

📰 科技脉搏 2026-07-26 🏢 公司追踪 A new class of intelligence for real work 介绍一种全新智能形态,专为实际工作场景设计。它突破传统AI局限,具备更强的推理、规划与执行能力,可自主完成复杂任务,显著提升工作效率,开启智能体处理真实业务的新纪元。 📅 04-23📎 OpenAI Research Our most capable and efficient frontier model for professional work 推出迄今为止能力最强、效率最高的前沿模型,专为专业工作优化。该模型在复杂推理、多步骤任务处理及领域知识应用上表现卓越,旨在成为专业人士的得力助手,推动生产力革命性提升。 📅 03-05📎 OpenAI Research 🔥 AI & 科技 SIMA 2An agent that plays, reasons, and learns with you DeepMind推出SIMA 2智能体,能与用户共同游戏、推理与学习。该代理通过自然语言交互理解指令,在复杂3D环境中协作执行任务,具备持续学习能力,为人机协同探索游戏及现实场景提供新范式。 📎 DeepMind Blog AlphaEarthMap our planet… Continue reading “📰 科技脉搏 [2026-07-26]”

📰 科技脉搏 [2026-07-25]

📰 科技脉搏 2026-07-25 🏢 公司追踪 Launching Health in ChatGPT OpenAI 产品更新:Launching Health in ChatGPT… 📅 07-23📎 OpenAI Blog Introducing Claude Opus 5 Anthropic 官方动态:Introducing Claude Opus 5… 📅 07-24📎 Anthropic Blog Frontier Red Team Anthropic 最新研究:Frontier Red Team… 📅 07-24📎 Anthropic Research How news organizations use AI to advance their vital missions OpenAI 产品更新:How news… Continue reading “📰 科技脉搏 [2026-07-25]”

📰 科技脉搏 [2026-07-23]

📰 科技脉搏 2026-07-23 🔥 AI & 科技 SoftReason: A Fully Differentiable Neuro-Soft-Symbolic Deductive Reasoning Architecture over High-Dimensional Perceptual Data 提出SoftReason,一种全可微分的神经-软符号演绎推理架构,能处理高维感知数据。通过将符号推理与神经网络无缝融合,在视觉问答等任务中实现端到端学习,显著提升复杂推理的准确性与可解释性。 📅 07-22📎 arXiv AI Papers Persian Pixel: A large-scale synthetic OCR dataset for Persian language 介绍Persian Pixel,一个大规模合成波斯语OCR数据集。包含数百万张多样化场景文本图像,覆盖多种字体、背景和噪声模式,为波斯语光学字符识别模型训练提供高质量基准,推动低资源语言文档数字化。 📅 07-22📎 arXiv AI Papers FMRP-LEAN: A HIPAA-Compliant AI-Augmented LIMS Architecture for End-to-End Clinical Assay Workflow Optimization 提出FMRP-LEAN,一种符合HIPAA合规的AI增强型实验室信息管理系统架构。通过集成大语言模型和自动化工作流,实现临床检测全流程优化,包括样本追踪、结果验证与报告生成,显著提升效率并降低人为错误。… Continue reading “📰 科技脉搏 [2026-07-23]”

📰 科技脉搏 [2026-07-22]

📰 科技脉搏 2026-07-22 🔥 AI & 科技 Copy Less, Ground More: Overcoming Repetitive Copying in Long-Context Reasoning via Evidence-Aware Reinforcement Learning 针对长上下文推理中模型重复复制输入文本的问题,提出基于证据感知的强化学习方法。通过引导模型关注关键证据而非机械复制,有效减少冗余输出,提升推理准确性与效率,为长文本理解任务提供新思路。 📅 07-21📎 arXiv AI Papers Appearance Pointers — Multimodal Region Control of Diffusion Transformers 提出外观指针机制,实现扩散变换器的多模态区域控制。通过引入可学习的空间-语义指针,精确引导图像生成过程中不同区域的视觉特征,支持细粒度局部编辑与风格迁移,显著提升生成可控性。 📅 07-21📎 arXiv AI Papers CodeRescue: Budget-Calibrated Recovery Routing for Coding Agents 提出CodeRescue预算校准恢复路由方法,用于编码智能体。通过动态评估任务复杂度与资源消耗,在预算约束下自动调整代码生成策略,当检测到错误时智能切换修复路径,提升代码生成成功率与资源利用率。 📅 07-21📎 arXiv AI Papers… Continue reading “📰 科技脉搏 [2026-07-22]”

📰 科技脉搏 [2026-07-21]

📰 科技脉搏 2026-07-21 🏢 公司追踪 and alignment in an era of long-horizon models 本文探讨了在长周期AI模型时代,如何确保模型与人类价值观对齐。文章分析了长期规划模型带来的新挑战,如目标一致性、安全性和可解释性,并提出了评估框架与对齐策略,为构建可靠、可控的AI系统提供了关键指导。 📅 07-20📎 OpenAI Blog 🔥 AI & 科技 Import AI 465: Open vs closed gaps; Kimi K3; Demis’ big policy plan 本文探讨AI领域开放与封闭系统的差距,介绍Kimi K3模型进展,并详述DeepMind联合创始人Demis Hassabis提出的重大AI政策计划,涵盖安全、治理与国际合作等关键议题。 📎 Import AI Automated Discovery Has No Universally Superior Harness 本文探讨自动化发现中“通用最优框架”的不存在性。通过理论分析与实验验证,证明不同任务与数据特性下,任何单一框架均无法在所有场景中表现最佳。研究为自动化发现系统的设计提供了重要指导,强调需根据具体需求定制框架。 📅 07-20📎 arXiv AI Papers Simple… Continue reading “📰 科技脉搏 [2026-07-21]”