共 22 篇相关文章

上海交通大学发布ARIS框架,实现从文献调研到审稿响应的科研全流程自动化。通过自我审查循环、评分门槛和人工干预机制,解决AI科研Agent长时间运行易跑偏的可靠性问题,已有论文被学术会议接受。

腾讯Hyra研究智能体与Hy3模型深度参与解决困扰数论界近50年的"和集与差集"最优指数问题,在有限集合构造优化中发挥实质作用,标志着AI从计算工具向数学发现伙伴的转变。

Reddit社区曝光OpenAI内部代号Astra模型,声称在数学与理论计算机科学领域取得十项进展。本文分析该传闻的可信度、AI数学推理能力的演进趋势,以及从解题到科研发现的跨越意义。

谷歌宣布向美国能源部创世纪计划投入4000万美元AI代币和Google Cloud额度,通过Gemini等AI模型帮助实验室研究人员加速科学发现,目标十年内将科研速度提升一倍。

OpenAI新一代AI模型仅用不到一小时,自动生成圈双覆盖猜想完整证明,震动数学界。本文深度拆解其三层架构、64个子代理协同机制、三页纸证明的真实可靠性,以及这一突破对人类数学家的深远影响。
用Claude做约束优化研究:AI自动化科研的潜力与局限
探讨Claude等大语言模型如何参与约束优化研究,涵盖问题建模、代码生成、求解器调用全流程。分析LLM在自动化科研中的真实能力边界,以及人机协作模式的务实路径。

本文系统拆解如何用AI Agent串联科研全链路——从文献管理、数据分析、论文写作、科研绘图到成果传播,构建可复用的科研自动化工作流。涵盖NotebookLM、N8N、Ollama等核心工具实战配置,帮助研究者把AI从聊天工具升级为真正的科研合作者。

OpenAI发布GPT-5.6系列,旗舰Sol、平衡Terra、轻量Luna三模型同步亮相。本文深度解析三款模型的能力定位、适用场景、定价差异及多智能体Ultra架构,帮助开发者和企业用户快速做出AI选型决策。


GeneBench-Pro是专为基因组学与生命科学设计的AI评测基准,采用真实世界数据集,覆盖基因组学、生物学及科研全流程,填补专业领域AI评测空白,助力AI辅助科研落地。

Firecrawl宣布重新免费开放服务,并同步发布SOTA研究索引,为AI科研代理提供实时科学知识库。本文深度解析这两大动作对RAG系统、科研推理及AI辅助科学发现的深远影响。

上海交通大学提出ARS(Auto Research in Sleep)开源框架,解决AI自主科研中生成与审查同源、长时间无监督运行的可信度难题。已有论文通过ARS全流程完成并被学术会议接收,构建人机协作的可信科研新范式。

实测OpenAI Codex用一段提示词在47分钟内从零生成完整算法论文,包含代码、图表和LaTeX文稿。详解提示词工程设计、生成质量评估及AI辅助科研的实际投稿经验。

AI原生的定义正在不断变化,昨天的最佳实践今天可能已经过时。本文分析AI原生标杆持续移动的原因,并提供三个实用策略帮助开发者和团队建立持续适应能力,在快速迭代的AI时代保持竞争力。

Google正式发布Gemini for Science,一套面向科学研究人员的AI工具套件,涵盖假设探索、大规模验证、文献解读等核心科研环节,助力加速科学发现进程。
产品体验实测GPT 5.5搭载Image 2.0在科研技术路线图绘制和毕业答辩PPT制作中的表现,对比Gemini Pro,分析Image 2.0的学科自适应能力、生成质量及实际科研应用价值。
教程攻略详解如何用Claude Code搭建结构化论文工作流,包含材料分类、文献证据匹配、审稿人模拟检查三个核心Skills的设计与实测,附六条可复用的AI辅助科研实践原则。
观点碰撞菲尔兹奖得主陶哲轩分享AI辅助数学研究的深刻体会:AI通过消除认知摩擦、降低试错成本,让数学家敢于探索更大胆的方向。他认为AI辅助科研已准备好进入主流,并倡导开放研究过程而非只展示结果。