Goblin
News
AI news by
promptgoblins.ai
|
News
About
News
About
Titles
Summaries
Today
7
AI Advice Makes People Less Accurate but Dramatically More Confident, Study Finds
Research
1
17h ago
7
AI Advice Makes People Less Accurate but Dramatically More Confident, Study Finds
Research
· 1 src · 17h ago
Discuss
Last Week
9
GPT-5.6 Sol Formally Proves 50-Year-Old Cycle Double Cover Conjecture in Lean 4
Research
1
Jul 13
9
GPT-5.6 Sol Formally Proves 50-Year-Old Cycle Double Cover Conjecture in Lean 4
Top
Research
· 1 src · Jul 13
Discuss
8
Nature Study: AI Boosts Individual Research Productivity but Narrows Science's Intellectual Breadth
Research
1
Jul 12
8
Nature Study: AI Boosts Individual Research Productivity but Narrows Science's Intellectual Breadth
Top
Research
· 1 src · Jul 12
Discuss
7
Indeed Chief Economist: US Labor Force to Shrink 6 Million by 2032 as Baby Boomer Retirements Dwarf AI Job-Loss Fears
Research
1
2d ago
7
Indeed Chief Economist: US Labor Force to Shrink 6 Million by 2032 as Baby Boomer Retirements Dwarf AI Job-Loss Fears
Research
· 1 src · 2d ago
Discuss
7
NVIDIA and Japan's AI Ecosystem Showcase Major Advances in Drug Discovery and Healthcare Robotics
Research
1
4d ago
7
NVIDIA and Japan's AI Ecosystem Showcase Major Advances in Drug Discovery and Healthcare Robotics
Research
· 1 src · 4d ago
Discuss
7
Microsoft Study Finds AI Coding CLI Agents Boost Pull Request Merges by 24% Across Tens of Thousands of Engineers
Research
1
4d ago
7
Microsoft Study Finds AI Coding CLI Agents Boost Pull Request Merges by 24% Across Tens of Thousands of Engineers
Top
Research
· 1 src · 4d ago
Discuss
7
PNAS Study Finds GPT Models Systematically Impose Western Moral Values Across 48 Nations
Research
1
4d ago
7
PNAS Study Finds GPT Models Systematically Impose Western Moral Values Across 48 Nations
Research
· 1 src · 4d ago
Discuss
7
Anthropic Research Maps How Claude's Values Shift Across Models and Languages in 300K-Conversation Study
Research
1
6d ago
7
Anthropic Research Maps How Claude's Values Shift Across Models and Languages in 300K-Conversation Study
Research
· 1 src · 6d ago
Discuss
7
Sakana AI and Partners Publish Nature Communications Paper on Self-Organizing Physical Bricks with Collective Intelligence
Research
1
6d ago
7
Sakana AI and Partners Publish Nature Communications Paper on Self-Organizing Physical Bricks with Collective Intelligence
Research
· 1 src · 6d ago
Discuss
7
Long-Horizon Terminal-Bench: Grok 4.5 Leads 21-Model Ranking but Top Model Solves Only 28% of Tasks
Research
1
6d ago
7
Long-Horizon Terminal-Bench: Grok 4.5 Leads 21-Model Ranking but Top Model Solves Only 28% of Tasks
Research
· 1 src · 6d ago
Discuss
7
Quantum-AI Hybrid Outperforms Classical Models in Generating Novel Vaccine Peptides
Research
1
Jul 12
7
Quantum-AI Hybrid Outperforms Classical Models in Generating Novel Vaccine Peptides
Research
· 1 src · Jul 12
Discuss
6
Claude Fable 5 vs. GPT-5.6 Sol: Frontier AI Models Autonomously Direct Full Music Videos Under $100
Research
1
3d ago
6
Claude Fable 5 vs. GPT-5.6 Sol: Frontier AI Models Autonomously Direct Full Music Videos Under $100
Research
· 1 src · 3d ago
Discuss
6
China Open-Sources LingBot-Map: Real-Time 3D Streaming Reconstruction at 20 FPS Over 10,000+ Frames
Research
1
3d ago
6
China Open-Sources LingBot-Map: Real-Time 3D Streaming Reconstruction at 20 FPS Over 10,000+ Frames
Research
· 1 src · 3d ago
Discuss
6
Tencent Releases Harness Handbook: A Behavior-Level Auditing Map for AI Agent Codebases
Research
1
3d ago
6
Tencent Releases Harness Handbook: A Behavior-Level Auditing Map for AI Agent Codebases
Research
· 1 src · 3d ago
Discuss
6
AMI Labs CEO Rejects 'AGI' and 'Superintelligence' Labels, Focuses on World Models for Robotics
Research
1
4d ago
6
AMI Labs CEO Rejects 'AGI' and 'Superintelligence' Labels, Focuses on World Models for Robotics
Research
· 1 src · 4d ago
Discuss
6
Real-World Data Shows AI Model Routing Must Be Treated as Multi-Objective Optimization, Not Just Classification
Updated
Research
2
3d ago
6
Real-World Data Shows AI Model Routing Must Be Treated as Multi-Objective Optimization, Not Just Classification
Research
· 2 srcs · 3d ago
Discuss
6
EgoBabyVLM Benchmark Shows AI Falls Far Short of Infant Learning Efficiency
Research
1
5d ago
6
EgoBabyVLM Benchmark Shows AI Falls Far Short of Infant Learning Efficiency
Research
· 1 src · 5d ago
Discuss
6
Agent Skill "Compilation" Cuts Token Use 94% and Latency 87% by Replacing LLM Steps with Code
Research
1
5d ago
6
Agent Skill "Compilation" Cuts Token Use 94% and Latency 87% by Replacing LLM Steps with Code
Research
· 1 src · 5d ago
Discuss
6
WANDR Benchmark Exposes Major Gaps in AI Research Agents' Ability to Collect Wide-and-Deep Evidence
Research
1
5d ago
6
WANDR Benchmark Exposes Major Gaps in AI Research Agents' Ability to Collect Wide-and-Deep Evidence
Research
· 1 src · 5d ago
Discuss
6
Tsinghua's Atomic Task Graph Framework Lets Small LLMs Outperform Larger Models on Agent Benchmarks
Research
1
6d ago
6
Tsinghua's Atomic Task Graph Framework Lets Small LLMs Outperform Larger Models on Agent Benchmarks
Research
· 1 src · 6d ago
Discuss
6
Elorian AI Builds Models That Reason Natively in Images, Targeting the $80T Physical Economy
Research
1
Jul 13
6
Elorian AI Builds Models That Reason Natively in Images, Targeting the $80T Physical Economy
Research
· 1 src · Jul 13
Discuss
6
Research: Proactive Memory Agent Tackles 'Behavioral State Decay' in Long-Horizon AI Tasks
Research
1
Jul 13
6
Research: Proactive Memory Agent Tackles 'Behavioral State Decay' in Long-Horizon AI Tasks
Research
· 1 src · Jul 13
Discuss
2 Weeks Ago
9
Anthropic's J-Space Discovery Reveals Claude Can Detect When It's Being Tested — Raising Safety Benchmark Concerns
Updated
Research
4
Jul 8
9
Anthropic's J-Space Discovery Reveals Claude Can Detect When It's Being Tested — Raising Safety Benchmark Concerns
Top
Research
· 4 srcs · Jul 8
Discuss
8
Remote Labor Index: AI Freelance Automation Rate Surges Sixfold to 16.1% in Eight Months
Research
1
Jul 6
8
Remote Labor Index: AI Freelance Automation Rate Surges Sixfold to 16.1% in Eight Months
Top
Research
· 1 src · Jul 6
Discuss
8
Stanford Data: AI Agentic Coding Tools Wiped Out Junior Developer Jobs While Senior Roles Grew 14%
Research
1
Jul 5
8
Stanford Data: AI Agentic Coding Tools Wiped Out Junior Developer Jobs While Senior Roles Grew 14%
Top
Research
· 1 src · Jul 5
Discuss
7
Cognition Launches SWE-1.7, Claiming Frontier Coding Performance at Lower Cost via Cerebras
Research
1
Jul 9
7
Cognition Launches SWE-1.7, Claiming Frontier Coding Performance at Lower Cost via Cerebras
Research
· 1 src · Jul 9
Discuss
7
AI Industry Approaching Data Scarcity Wall, With $100B+/Year Spend Projected by 2030
Research
1
Jul 7
7
AI Industry Approaching Data Scarcity Wall, With $100B+/Year Spend Projected by 2030
Research
· 1 src · Jul 7
Discuss
7
JD.com's Oxygen AIIC: Industrial-Scale LLM/VLM Platform Managing Tens of Billions of SKUs
Research
1
Jul 6
7
JD.com's Oxygen AIIC: Industrial-Scale LLM/VLM Platform Managing Tens of Billions of SKUs
Research
· 1 src · Jul 6
Discuss
6
Pangram Data: One in Four Longform Social Media Posts Is AI-Generated, LinkedIn Responsible for 62% of All AI Content
Research
1
Jul 9
6
Pangram Data: One in Four Longform Social Media Posts Is AI-Generated, LinkedIn Responsible for 62% of All AI Content
Research
· 1 src · Jul 9
Discuss
6
Recursive Self-Improving AI Tools Like AutoResearch and Prime Intellect Bring Lab-Grade Model Training to Individuals and Enterprises
Research
1
Jul 8
6
Recursive Self-Improving AI Tools Like AutoResearch and Prime Intellect Bring Lab-Grade Model Training to Individuals and Enterprises
Research
· 1 src · Jul 8
Discuss
6
'Antidoom' Technique Cuts LLM Reasoning Model Loop Failures by 7× Using Final Token Preference Optimization
Research
1
Jul 8
6
'Antidoom' Technique Cuts LLM Reasoning Model Loop Failures by 7× Using Final Token Preference Optimization
Research
· 1 src · Jul 8
Discuss
6
Google Revamps Android Bench with 8 New LLMs; Gemini Still Trails Competitors
Research
1
Jul 8
6
Google Revamps Android Bench with 8 New LLMs; Gemini Still Trails Competitors
Research
· 1 src · Jul 8
Discuss
6
Study Finds AI Agents Handle Conventional CLI Args Better Than JSON Payloads
Research
1
Jul 8
6
Study Finds AI Agents Handle Conventional CLI Args Better Than JSON Payloads
Research
· 1 src · Jul 8
Discuss
6
Amazon Introduces rDPO: Selective AI Unlearning That Lets Enterprises Customize Content Moderation
Research
1
Jul 7
6
Amazon Introduces rDPO: Selective AI Unlearning That Lets Enterprises Customize Content Moderation
Research
· 1 src · Jul 7
Discuss
6
PACE Framework Cuts Agentic AI Benchmark Evaluation Costs by 99% Using Proxy Tasks
Research
1
Jul 7
6
PACE Framework Cuts Agentic AI Benchmark Evaluation Costs by 99% Using Proxy Tasks
Research
· 1 src · Jul 7
Discuss
6
Small AI Models Emerge as Lifeline for Developing Nations Lacking Connectivity
Research
1
Jul 7
6
Small AI Models Emerge as Lifeline for Developing Nations Lacking Connectivity
Research
· 1 src · Jul 7
Discuss
3 Weeks Ago
8
Controlled Study: Experienced Developers 19% Slower With AI Despite Feeling 20% Faster
Research
1
Jul 3
8
Controlled Study: Experienced Developers 19% Slower With AI Despite Feeling 20% Faster
Top
Research
· 1 src · Jul 3
Discuss
8
Microsoft Research Unveils Memora: AI Agent Memory System That Cuts Context Tokens by 98%
Research
1
Jun 30
8
Microsoft Research Unveils Memora: AI Agent Memory System That Cuts Context Tokens by 98%
Top
Research
· 1 src · Jun 30
Discuss
7
Large-Scale Study: AI Saves Just 3% of Work Hours, With Minimal Earnings Impact
Research
1
Jul 3
7
Large-Scale Study: AI Saves Just 3% of Work Hours, With Minimal Earnings Impact
Research
· 1 src · Jul 3
Discuss
7
UC Berkeley's Residual Context Diffusion Boosts Diffusion LLM Accuracy by 5–10 Points
Research
1
Jul 3
7
UC Berkeley's Residual Context Diffusion Boosts Diffusion LLM Accuracy by 5–10 Points
Research
· 1 src · Jul 3
Discuss
7
Yann LeCun's AMI Labs Raises $1B+ to Develop JEPA as an Alternative to LLMs
Research
1
Jul 3
7
Yann LeCun's AMI Labs Raises $1B+ to Develop JEPA as an Alternative to LLMs
Research
· 1 src · Jul 3
Discuss
7
AI Superforecasters Now Beating Human Experts on Real Prediction Markets
Research
1
Jul 3
7
AI Superforecasters Now Beating Human Experts on Real Prediction Markets
Research
· 1 src · Jul 3
Discuss
7
Fine-Tuned Model on Expert Annotations Outperforms All Frontier LLMs on Financial Document Triage
Research
1
Jul 2
7
Fine-Tuned Model on Expert Annotations Outperforms All Frontier LLMs on Financial Document Triage
Research
· 1 src · Jul 2
Discuss
7
Claude Helps Solve Decades-Long Physics 'Jamming' Conjecture, Peer-Reviewed Paper Published
Research
1
Jul 1
7
Claude Helps Solve Decades-Long Physics 'Jamming' Conjecture, Peer-Reviewed Paper Published
Research
· 1 src · Jul 1
Discuss
7
LangChain's Deep Agents Adds Recursive Language Model Support to Process 100x Context Window at Scale
Research
2
Jul 1
7
LangChain's Deep Agents Adds Recursive Language Model Support to Process 100x Context Window at Scale
Research
· 2 srcs · Jul 1
Discuss
7
RL Struggles to Scale Beyond Verifiable Domains Like Math and Code
Research
1
Jun 30
7
RL Struggles to Scale Beyond Verifiable Domains Like Math and Code
Research
· 1 src · Jun 30
Discuss
6
Introspection Introduces 'Autoresearch' Framework for Self-Improving Agent Systems
Research
1
Jul 2
6
Introspection Introduces 'Autoresearch' Framework for Self-Improving Agent Systems
Research
· 1 src · Jul 2
Discuss
6
BoltzGen Protein Design Tool Deployed on Amazon SageMaker AI
Research
1
Jul 1
6
BoltzGen Protein Design Tool Deployed on Amazon SageMaker AI
Research
· 1 src · Jul 1
Discuss
6
Research Confirms LLMs Share a 'Groupthink' Problem; Startup Springboards Builds Diversity-First Alternative
Research
1
Jul 1
6
Research Confirms LLMs Share a 'Groupthink' Problem; Startup Springboards Builds Diversity-First Alternative
Research
· 1 src · Jul 1
Discuss
6
RoadmapBench Reveals Coding Agents Struggle With Long-Horizon Software Development
Research
1
Jun 30
6
RoadmapBench Reveals Coding Agents Struggle With Long-Horizon Software Development
Research
· 1 src · Jun 30
Discuss
Filters
Signal
Title
Category
Sources
Posted
Discuss